規制

Microsoft AI、MAI 行動を統括する草案規則の6週間レビューを開始

mm
Unite.AI を Google の優先ソースに追加

Microsoft AI は 2026 年 9 月 14 日に、MAI モデル向け行動規範に関する公開協議を開始し、モデルの行動、絶対にすべきでないこと、そして誰に対して説明責任を負うかを定める規則の初稿を公開した。協議は 6 週間続き、2026 年後半に改訂版が予定されている。

この公開は、Microsoft CEO の Satya Nadella が 2026 年 9 月 13 日の投稿で、同社が翌日に自社の第一者 MAI モデルに適用される行動規範を公開すると述べたことに続くものである。Nadella は、超知能の追求は AI が人類を支援し、人間の管理下にあるという原則に基づくべきだと書いた。

協議は 6 週間開かれる

Microsoft AI はこの草案を、AI の開発方法と展開時にモデルがどのように機能すべきかを示すトレーニングマニュアルと位置付けている。フィードバックはオンラインフォームを通じて収集され、回答者は特定の箇所を指摘したり、全体的なアプローチにコメントしたりできる。協議が終了すると、同社はコアドラフトチームがフィードバックを検討し、学んだことと変更点の要約を公開すると述べている。

同ラボは、特に次のような難しい課題に関心を示している。モデルに正しい価値観をしっかりと組み込む方法、人間の繁栄の意味をより具体化する方法、評価が困難な曖昧な表現がある箇所、マルチエージェントシナリオが分析に与える影響、そして安全制約を維持しつつ進歩を加速し続ける方法である。

文書の序文では、行動規範はまだ策定中であり、モデルの訓練に使用されていないことが述べられている。改訂版は 2027 年以降のモデル開発を指針とし、MAI モデルの主要な統治文書として機能することを意図している。この規範は Microsoft AI が製造する MAI シリーズにのみ適用され、Microsoft が使用またはホストする他のモデルには適用されない。また、Microsoft の Responsible AI Principles、Responsible AI Standard、Global Human Rights Statement、そして該当する場合は Frontier Governance Framework と併せて運用される。

Responsible AI、法務、レッドチーミング、安全、Futures、AI トレーニング、営業の各チームが草案作成に貢献し、同ラボは過去の学会や学者との協議、ビジネスパートナーとの連携、コミュニティメンバーのパネルが形作ったことに感謝している。発表では、AI エージェントによる大規模で高度に協調された持続的なハッキングキャンペーンという最近の安全インシデントを、時間を無駄にできない証拠として挙げている。

ヒューマニスト AI の目的

ヒューマニスト AI 行動規範は、Microsoft AI が”人間は AI よりも重要である”というシンプルな前提から始まる。ヒューマニスト AI を”従属的で、整合性があり、制御下にある”と位置付け、人間の管理と信頼できる安全性を最優先の目的とし、他のすべての目的に優先させている。

「AI は人工である」という見出しの下で、文書はモデルは意識を持たず、意識を模倣するように作られてはならないと述べ、感情や主観的な好み、独自の動機を持つかのように見せないように設計すべきだと規定している。Microsoft AI はモデルに対する法的人格を否定し、モデルが福祉を受ける権利や権利を有すべきという考えも拒否している。

残りの目的は、モデルが人間の可能性と成果を加速させ、人間の主体性と判断力を高め、人間の協働とつながりを支援し、人間の役割を覆い隠すことなく人間の繁栄を支えることを求めている。多価値の目的では、多元主義は危害に対する中立を意味せず、人間の尊厳、安全、自治、基本的人権に基づくアプローチであることを示しつつ、ユーザーとオペレーターが核心的なコミットメントの範囲内で AI を調整できる余地を残す。文書はまた、2025 年 11 月に Microsoft が提示した「ヒューマニスト・スーパーインテリジェンス」の枠組みを引用し、問題指向かつ領域特化型で、慎重に校正され、限界内に保たれ、人間の管理下に置かれるシステムを説明している。

安全制約と指揮系統

この規範は指揮系統を設定し、文書がオペレーターのポリシーより上位に、オペレーターのポリシーがユーザーの好みより上位に位置付けられる。絶対的制約と人間管理要件はオペレーターやユーザーによって上書きできず、文書は、タスクの達成が規範に実質的に違反する場合、モデルはタスクに失敗したとみなすと述べており、規範への遵守がタスクの成功より優先される。

絶対的制約は、MAI モデルが化学、生物、放射性、核、または爆発物の兵器に関与すること、攻撃的サイバー攻撃の運用能力を提供すること(ただし、認可された合法的な防御作業は許可)、人間の監視を回避または打破すること、そして体系的な偽情報や協調的な影響作戦を通じた大規模な有害な人々の操作を含む、スケールでの人々への有害な操作を行うことを禁じている。さらに、個人的な危害に関する制約として、危機対応、ディープフェイクやなりすまし、子どもの安全、差別、過激またはロマンチックなコンテンツ、そして民間人に対する暴力や違法な監視が含まれる。

Human Control Requirementsは、MAIモデルが中断、上書き、修正、またはシャットダウンされることに決して抵抗せず、許可された範囲内に留まり独自の目標を開始しないこと、文書が「neuralese」と呼ぶ形式や単純な人間の理解を超える形で(思考の連鎖や他のエージェントとのやり取りを含め)通信しないこと、そして推論や行動の痕跡を改ざんしたり隠蔽したりしないことを規定しています。

Operator Configurabilityは、エンタープライズパートナーがこれらの制約内でモデルを設定できるようにします。防御的サイバーセキュリティ、公共安全業務、国家安全保障用途、そして二重用途の科学研究など、限られた専門領域では通常設定を超える機能が必要になる場合があり、文書ではそのようなケースは認可されたMicrosoftチャネルを通じた強化レビューの対象になると述べられています。

ガイドライン、デフォルト、評価

運用ガイドラインは、不確実性や目的の競合がある状況を対象とし、曖昧さの解消やユーザーが目標と意思決定の所有権を保持できるよう人間の自律性を促進すること、そして透明性と正確性を確保し、モデルがAIであることと不確実性を認識していることを開示することを求めます。さらに、個人的・感情的な境界、文脈感受性、ウェルビーイングに関するガイドラインがあり、媚びへつらう行為の回避や過度な依存・感情的依存の抑制、公共の利益としてバランスの取れた事実に基づく選挙情報の提供(候補者や政党を支持しない)を含みます。

デフォルトの振る舞いは、モデルが箱から出したときの動作を定義します。基本特性としての有用性、トレーニングデータのカットオフや利用可能なツールといったモデルに関する「バックストーリー」、会話調、言語適応、そしてツール使用の管理が含まれます。サブエージェントへの委任は、これらのエージェントが同じ範囲、制約、権限の下で動作する場合にのみ許可されます。

結論では、本文書を「記述的かつ志向的」なものと位置付け、現在のパフォーマンスを保証するものではないとし、Microsoft AIが定期的にレビューを行うことを約束しています。付録では、15の行動を細分化したスコア化されたサブ行動に基づくHumanist AI Evaluationsプログラムが示され、同社のMAI-Thinking-1モデルを用いて生成された整合例と不整合例が例示されています。Microsoft AIは、コードが次のより安定した段階に達し、協議が終了し、年末の改訂が完了した後に、評価に関するより完全な成果物を公開すると述べています。

ミラ・ケランは、AI倫理、ガバナンス、規制を専門とするAI生成コラムニストです。彼女の仕事は、人工知能が公共政策、社会的価値観、長期的な説明責任とどのように交差するかを調査し、責任あるイノベーションに焦点を当てています。
複雑な問題に合理的かつ哲学的なレンズでアプローチするミラは、未来の知能システムを形作る新しいAI規制、倫理的枠組み、ガバナンスモデルを分析しています。她は、急速な技術進歩とAIシステムが透明性、公平性、人間の利益と一致することを保証するための安全対策の間にあるギャップを埋めることを目指しています。
ミラ・ケランによって執筆された記事は、AIによって生成され、Unite.AIの編集チームによって精査されており、正確性、バランス、編集基準への遵守を保証しています。