サイバーセキュリティ

Microsoft、コードネームMDASHエージェントAIスキャンをAzure Governmentへ導入

mm
Unite.AI を Google の優先ソースに追加

Microsoftのマルチモデル・エージェントスキャンシステム(コードネームMDASH)は、ソフトウェアのセキュリティ欠陥を検出するためにMicrosoft Azure Governmentへ展開され、同社は発表しました2026年9月8日、プレビューアクセスは選択された米国政府顧客および認定パートナーに提供されています。

Azure Government 内の Defender 機能

この発表は、Microsoft Specialized Clouds の社長兼最高技術責任者である Douglas Phillips によって作成されました。Azure Government では、MDASH は Microsoft Defender の機能として提供され、FedRAMP High 認証を受けた Microsoft Foundry サービス内で利用可能なモデルと連携します。Azure Government は、審査された米国市民が運用する別個の隔離されたクラウドで、連邦政府、国家安全保障、州・地方自治体の顧客のコンプライアンス要件を満たすよう構築されており、FedRAMP High 認証および Department of War の認定を受けた制御されたミッションクリティカルなワークロードに対応しています。Microsoft は、この体制により、機関のソースコードとシステムがそれについて学習したすべての情報が、すでにデータ取り扱いが承認された境界内に留まることができると述べています。

Microsoft は、数か月間自社のソフトウェアでコードネーム MDASH を使用しており、国家安全保障機関や民間機関の顧客もすでにその機能を検証中であると述べました。発表によると、各機関はミッションの重要度でソフトウェアを順位付けし、リストを順に着実に進めており、目標はコードカバレッジを 100% にすることだとしています。

エージェントスキャナーの仕組み

Microsoft は、MDASH をエージェント型コードスキャナーとして説明しており、ソースコード内の悪用可能な脆弱性を検出し検証します。従来のスキャンツールが既知のパターンライブラリとコードを照合するのとは異なり、システムは専門的なセキュリティ研究者と同様にソフトウェアを読み取り、情報がプログラム内をどのように流れるかを追跡して、弱点が実際に悪用可能かどうかを判断します。100 以上の専門 AI エージェントが様々なモデルを活用し、同一のコードベース上で作業し、各エージェントは異なるカテゴリの弱点を認識するよう訓練されています。これらの検出結果は、疑わしい欠陥が実際に到達可能でかつ危険であるかどうかを賛否両論で議論する第二のエージェント群に渡されます。その後、ハーネスは結果を統合・重複除去し、可能な限り欠陥を実証して示すことで、Microsoft が「洗練され優先順位付けされた脆弱性リスト」と表現する形で提供します。

Microsoft の製品ドキュメントでは、マルチステージのパイプラインが示されています: コールグラフ解析とコード複雑度指標を用いてリスクでファイルを順位付けする Prepare ステージ、インジェクション、メモリ安全性、認証バイパス監査者などのロール固有エージェントを実行する Scan ステージ、汚染分析とマルチモデルディベートを適用して信頼度を高め偽陽性を排除する Validate ステージ、重複検出を統合する Dedup ステージです。システムを初めて公開的に詳細説明した2026年5月12日のセキュリティブログ投稿では、バグクラスが許容するトリガー入力を構築・実行する追加の Prove ステージが記述されています。

文書化された機能には、各検出項目に対する細かな信頼度スコア、Defender CLI の defender fix コマンドを介した AI 生成コード修正、Microsoft Security Exposure Management における結果の集中管理、GitHub および Azure DevOps 用コネクタが含まれます。ドキュメントによれば、MDASH はコードベース全体で汎用的に動作し、主要なプログラミング言語すべてをサポートします。特に C、C++、Java、C# に深い専門知識を持つようチューニングされたエキスパートエージェントが用意されています。

報告された結果と過去の開発

Microsoft は、MDASH が実世界の脆弱性に関する公開ベンチマークである CyberGym で 96.55 点を取得し、同社の過去の脆弱性事例で検証された自社コードでも同様の結果を示したと述べています。

5月12日の投稿では、ハーネスが StorageDrive(Microsoft が攻撃的セキュリティ研究者の面接時に使用するプライベートサンプルドライバ)に意図的に埋め込んだ 21 件すべての脆弱性を検出し、偽陽性はゼロであったと報告されています。また、clfs.sys Windows コンポーネントにおける 28 件の確認済み Microsoft Security Response Center ケースに対して 96% の再現率、tcpip.sys の 7 件のケースに対して 100% の再現率(いずれも 5 年間にわたる)を示し、CyberGym の 1,507 件の実世界脆弱性再現タスクのコーパスで 88.45% のスコアを獲得したと述べています。Microsoft は、当時このスコアがベンチマークの公開リーダーボードで最高であったとしています。同じ投稿では、システムが研究者に対し、2026年5月12日の Patch Tuesday 向けに Windows のネットワークおよび認証スタック全体で 16 件の新たな脆弱性を発見させたと報告されており、その中には Windows カーネル TCP/IP スタックや IKEv2 サービスなどのコンポーネントにおける 4 件のクリティカルなリモートコード実行欠陥が含まれます。当時、このシステムは限られた顧客向けのプライベートプレビュー段階にありました。

MDASH は、Microsoft の Autonomous Code Security チームによって構築されました。同チームのメンバーには、オープンソースプロジェクトの実際のバグを発見・修正する自律的サイバー推論システムで DARPA AI Cyber Challenge に勝利した Team Atlanta のエンジニアが含まれています。

2026年8月13日、Microsoft はMDASH 内に MAI-Cyber-1-Flash を導入しました。これは同社の MAI-Thinking-1 系列から派生したコンパクトなセキュリティモデルで、Mustafa Suleyman と Hayete Gallot が執筆した投稿で紹介されています。Microsoft は、このモデルがスキャンタスクの最大 90% を処理でき、特に困難な 10% のタスクには GPT-5.4 を予約するよう設計されており、従来 MDASH で提供されていた最高のモデル組み合わせと比較してコストを 50% 削減できると述べました。同社は、統合システムの CyberGym any‑crash スコアが 96% であると報告し、目標の any‑of スコアが 90.4%、最終提出スコアが 86.3% であることを補足しています。Microsoft は、このモデルが AI Red Team によって評価され、自動化および専門家主導の敵対的演習でテストされ、第三者による独立評価も受けたと述べています。

マルチモデル設計と脅威のフレーミング

Microsoft は、ハーネス設計が主要な差別化要因であると述べています: 特定タスクに最適なモデルを指示・調整するシステムであり、新しいモデルが登場しても再構築せずに採用できるため、システム下流で機関が投資したすべてが引き継がれます。政府向けの発表では、MAI モデルファミリーへの最新追加により、個別スキャンのコストがほぼ半減する見込みだとされています。

この発表は、脅威アクターが AI 能力に投資していることを背景に位置付け、ディフェンダーにとって唯一の永続的な優位性は時間であり、弱点が発見・修正されるまでのギャップと、他者がそれを見つけるまでの時間差であると主張しています。アクセスを希望する組織は、Azure Government の MDASH について Microsoft のアカウントチームへ問い合わせるよう案内されています。

マイルズ・オカダは、Unite.AIのAI生成アナリストで、人工知能とサイバーセキュリティを扱い、特に新たな脅威、防御アーキテクチャ、自動化システムとの関係の変化に焦点を当てています。彼の仕事は、AIがセキュリティ運用をどのように変えているか、自律的な脅威検出と対応から対立的なAI技術の台頭までを調査しています。
技術的かつ調査的な視点から、マイルズはセキュリティ研究、インシデント開示、実世界での展開を分析して、AIが防御を強化する場所と、新たな脆弱性を導入する場所を理解しています。特に、モデルへの悪用、データの汚染、攻撃の自動化、そしてAIを搭載したシステムを大規模に保護することの運用上の現実に注目しています。
マイルズ・オカダによって執筆された記事は、AIによって生成され、Unite.AIの編集チームによって検証されており、急速に変化するAIセキュリティの状況について、正確性、厳格性、責任ある報道を保証しています。