サイバーセキュリティ
マイクロソフト、最初のサイバーモデルをProject Perceptionに組み込む

マイクロソフト (MSFT ) は、Project Perception を発表しました。これは、3 つのクラスの AI エージェントを顧客の環境に導入するセキュリティ システムであり、MAI-Cyber-1-Flash とともに提供されます。MAI-Cyber-1-Flash は、マイクロソフトが社内でトレーニングした最初のセキュリティ モデルです。パブリック プレビューは 2026 年 8 月 3 日に開始されます。
マイクロソフトが主張するのは、価格についてです。Hayete Gallot は、2026 年 2 月にマイクロソフトに復帰し、セキュリティ担当のエグゼクティブ バイス プレジデント に就任しました。Gallot は、マイクロソフトが「サイバースタック」と呼ぶ新しいセキュリティ アプローチ を発表しました。防御は継続的に実行されなければならないが、継続的な防御は費用対効果が良くなければなりません。フロンティア モデルをすべてのセキュリティ タスクに適用することは、特に 脆弱性の発見と悪用のコストが低くなっている ため、問題を解決しません。
MAI-Cyber-1-Flash は、この制約に対する答えです。このモデルは小さく、コードにチューニングされており、マイクロソフトの MAI-Thinking-1 ラインから派生しています。MDASH という名前のエージェントのハーネスの中に組み込まれており、そこでは 100 を超えるエージェントがソフトウェアの脆弱性を発見して修復します。MAI-Cyber-1-Flash は、そこでの作業の 90% を吸収するように設計されており、最も難しい 10% のタスクのみを OpenAI の GPT-5.4 にエスカレートします。
同じベンチマーク スコアに対するコストの半分
マイクロソフトは、MDASH が MAI-Cyber-1-Flash と GPT-5.4 を実行すると、CyberGym で 96% のスコアを達成し、Anthropic の Mythos よりも 12 ポイント高いスコアを達成すると報告しています。また、このペアは、現在マイクロソフトが提供している構成よりも約半分のコストで実行されることも報告しています。
スコア自体は変化しません。2026 年 6 月 2 日の Build 2026 で、マイクロソフトは MDASH に対して 96.55% のスコアを報告しました。これは、ハーネスが拡張プレビューに入ったときでした。3 週間前には、88.45% のスコアを報告しました。同社は、Windows ネットワーキングおよび認証スタックで 16 の脆弱性を発見し、そのうち 4 つはリモート コード実行の脆弱性でした。マイクロソフトは、同月のパッチサイクルでこれらの脆弱性を修正しました。能力曲線は、6 月初旬以来平坦でした。コスト曲線が変化しました。
その区別は、製品全体です。 CyberGym は、UC バークレーのベンチマークで、188 のオープンソース プロジェクトにわたる 1,507 の実際の脆弱性を含みます。Google の OSS-Fuzz コーパスから抽出されています。エージェントはコードベースとバグの説明を受け取り、クラッシュを再現する入力を書かなければなりません。当時、Dawn Song のグループがこのベンチマークを発表したとき、最も強力なエージェントとモデル ペアは約 20% のスコアを達成しました。13 か月でこのベンチマークを満たすことは、能力に関する疑問を解決します。購入者にとって残されたのは、毎日、毎日、毎回、トークン料金がスキャニングの範囲を決定することなく、全エステートに対してこの能力を実行できるかどうかです。
Mythos の比較には、名前のある非対称性があります。Anthropic は、モデルを一般公開せず、Project Glasswing を通じて、セキュリティ パートナーにのみモデルを配布 しています。マイクロソフトは、代替モデルを、企業が簡単に購入できるものとして販売しています。Nvidia (NVDA ) は、同じ日に、オープン ウェイト ディフェンシブ モデルと共有ツールを中心としたアライアンス を発表しました。
レッド、ブルー、グリーン エージェント
Perception は、作業を 3 つの役割に分割します。レッド エージェントは、攻撃者が取ることができるルートをマッピングします。ブルー エージェントは、生成されたシグナルを処理し、どれが真正のリスクを表すかを決定します。グリーン エージェントは、修正を適用し、タッチしたものを強化します。各ステージで人間のハンドオフなしに出力がエージェント間で交換されますが、マイクロソフトは、高い影響力のあるアクションは人間の承認の下に残ることを示しています。
エージェントの下には、経済が機能するかどうかを決定する共有セキュリティ コンテキストのレイヤーがあります。マイクロソフトは、組織の資産、ID、関係、活動の継続的に更新されるピクチャーを維持しており、エージェントは生のテレメトリからそれを再構築するのではなく、そのマップから始めます。同社は、これを精度の向上とコンピューティングの節約として位置付けているが、常にオンのシステムでは、これらは同じ問題です。
マイクロソフトは、モデルがセキュリティを優先するバイアスで調整され、自動および専門家主導のアドバーサリアル テストを通じて AI レッド チームによって評価され、外部の評価者によってレビューされたと述べています。MDASH の顧客は、テナント分離、ロールベースのアクセス制御、監査ログ、インターネットにアクセスできないサンドボックス化された実行環境を受け取ります。
プレビューで提供されるもの
Perception は、最初に Microsoft Defender に導入され、以降は Microsoft Security に拡大します。価格は、消費ベースでセキュリティ コンピューティング ユニットで測定され、エージェントのタスクの重さに応じてユニット数が増えます。つまり、スキャニングの範囲はライセンス ティアではなく予算の行になります。マイクロソフトは、Perception とセキュリティ コピロット (Security Copilot) の間には明確な線を引いています。1 つはアクションを実行し、もう 1 つはアシストします。
ソフトウェアの脆弱性管理は、MAI-Cyber-1-Flash が処理する最初のワークフローです。マイクロソフトは、Perception がプレビューの拡大に伴って、セキュリティ ワークフローをより多くモデルを介してルーティングすることを示しています。ここで、AI ドリブンの脆弱性発見の経済 が、ベンチマーク タスクではなく、実際の顧客エステートに対してテストされます。












