AIモデルとプラットフォーム
私たちがAIを整列させるのではなく、文明を整列させている

数多くの年間、人工知能(AI)における主要な質問は、AIモデルを人間の価値観と整列させる方法でした。研究者たちは、AIの意思決定を導く安全性のルール、倫理的原則、制御メカニズムを定義しようとしました。この作業により、重大な進歩が達成されました。しかし、今、AIシステムがより能力が高く、広く普及するにつれて、整列の焦点は変化し始めています。単一のモデルを単一の指令セットに整列させるという課題が、グローバルスケールでこれらのシステムを使用する文明を整列させるという、はるかに大きな課題に変わりました。AIは、単なるツールではありません。社会が働き、コミュニケーションをとり、交渉し、競争する環境に進化しています。結果として、整列は技術的な問題ではなくなりました。文明の問題になりました。この記事では、整列が単にモデルに関するものではなく、機械ではなく文明について考える必要がある理由を説明します。また、この変化が私たちの責任にどのような影響を与えるか、そしてグローバル協力のために何を意味するかについても議論します。
AIが実際にどの価値を表現するのか?
あなたがAIにデリケートな歴史的出来事について尋ねると、その答えは、AIが学習したデータに依存します。そのデータが主に西側のインターネットから来ている場合、答えは西側の偏見を持つでしょう。個人の主義、自由な発言、民主主義的理想を優先します。これらの価値は多くの人にとって良きものですが、世界で唯一の価値ではありません。
シンガポールのユーザー、リヤドのユーザー、サンフランシスコのユーザーは、それぞれ「役に立つ」と「有害」なものの定義が異なります。ある文化では、社会的調和が絶対的な自由な発言よりも重要です。他の文化では、階層への尊重が混乱よりも重要です。
シリコンバレーの会社が「人間のフィードバックからの強化学習」(RLHF)を使用する場合、AIの答えを評価するために人間を雇います。しかし、これらの人間は誰ですか?彼らの信念は何ですか?もし彼らがアメリカの基準にモデルを整列させると、偶然にアメリカの文化輸出を構築しています。彼らは、他の文化のルールを世界に押し付けるデジタル外交官を構築しています。
フィードバックループの台頭
課題は、AIが単一の文化の信念を反映することだけではありません。それらの信念が私たちを変える可能性があることです。現代のAIシステムは、個人の行動、組織、さらには国家を形作る可能性があります。彼らは、私たちが考え、働き、信頼し、競争する方法に影響を与える可能性があります。これにより、AIシステムと人間の社会の間でフィードバックループが生まれます。私たちがAIを訓練し、AIが私たちが考え、行動する方法を形作ります。これらのループは、AIがより普及するにつれて強くなります。このフィードバックループの動作を確認するには、以下の2つの例があります:
- 大規模なAIの展開は社会的行動を変え、社会的行動は新しいシステムを訓練するデータを変えます。たとえば、レコメンドアルゴリズムは、人々が何を見たり、読んだり、信じるかを形作る可能性があります。生産性ツールは、チームが協力し、学生が学ぶ方法を形作ります。これらの行動の変化は、異なる視聴習慣、職場のコミュニケーションパターン、または書き方などのデータパターンの変化につながります。このデータが将来の訓練データセットに流れ込むと、モデルはその仮定と出力を調整します。人間の行動がモデルを形作り、モデルが人間の行動を形作ります。
- 自動化された意思決定ツールは、公共政策に影響を与え、公共政策は将来のモデル訓練に影響を与えます。たとえば、多くの政府は、AIを使用して、どの地域にリソースを割り当てるべきか(たとえば、どの地域がより多くの医療サポートを必要としているか、またはどの地域がより高い犯罪リスクがあるか)を提案するために使用しています。政策立案者がこれらの提案に基づいて行動すると、決定の結果は後に新しいデータセットの一部となります。時間の経過とともに、AIによって形作られた政策決定は、次の世代のAIモデルを形作ります。
これらのフィードバックループを認識すると、AIが徐々に文明を形作り、整列させていることが明らかになります。結果として、国家は、AIを社会や制度に統合する際に、どのようにしてその価値観を守ることができるかを尋ね始めています。
主権AIの出現
この整列の課題は、世界中の政府から重大な反応を引き起こしています。国家は、輸入されたAIに頼ることは主権のリスクであることを認識しました。彼らは、外国人のように考えているブラックボックスによって、市民が教育を受けたり、情報を得たり、助言を受けたりすることを許すことはできません。
この認識は、「主権AI」の出現につながりました。フランスは、フランス語を話し、フランスの法律と文化を理解するモデルを構築するために多大な投資をしています。インドは、文化的価値を確保するために、在来のAIモデルを構築しています。アラブ首長国連邦と中国は、独自の国家ビジョンに整列したAIモデルを構築しています。
これが新しい軍拡競争です。これは、物語の制御をめぐる競争です。独自のAIを持たない文明は、最終的に独自の記憶を失うことになります。如果あなたの子供が機械に質問をして、機械が別の文化の論理で答える場合、あなたの文化は侵食され始めます。この認識は、しかし、異なるデジタルブロックの形成につながる可能性があります。私たちは、西側のAI、中国のAI、インドのAIなど、異なるシステムを持つことになるかもしれません。これらのシステムは、異なる事実と異なる道徳的指針で動作します。これらの開発は、真正に整列した単一のAIモデルを作成したい場合、文明を整列させる方法を見つける必要があることを明確に示しています。
外交的AIの必要性
従来の整列は、モデルが慎重な訓練、プロンプト、ガードレールによって整列できるという仮定に基づいています。この考え方は、初期のAI安全性研究の技術的な思考から来ています。しかし、完璧なモデルレベルの整列は、文明を整列させる課題を解決することはできません。整列は、社会が反対方向に引っ張られる場合、安定したままにはなりません。国、企業、コミュニティが相反する目標を持っている場合、AIシステムをその相反に整列させるでしょう。これらの限界は、整列が技術的な問題ではなく、統治、文化、調整の問題であることを示しています。これらの問題は、専門家や開発者だけではなく、全ての文明に関係しています。
では、どのように進むべきか?もし、普遍的な整列は不可能であることを受け入れるなら、私たちが戦略を変える必要があります。哲学的な問題に対する技術的な解決策を探すのを止める必要があります。外交官のように考えることを始める必要があります。私たちは、「文明の整列」のためのプロトコルを構築する必要があります。私たちは、AIが他の文化の信念を押し付けることなく、社会の信念と価値を尊重する方法を考え出す必要があります。つまり、私たちは、アルゴリズムのためのデジタル国連が必要です。
これには、透明性が必要です。現在、ニューラルネットワークの深い層に隠された価値については、実際には何もわかりません。私たちが見るのは、出力だけです。文明を整列させるには、各モデルの「憲法」について明確にする必要があります。モデルは、その偏見を宣言できる必要があります。モデルは、「私はこのデータで訓練されました。この安全性のルールで。この価値を優先します」と言える必要があります。偏見が見えるようになると、システムを信頼できるようになります。ユーザーは、視点を切り替えることができる必要があります。ユーザーは、質問をして、「西側」のモデルがどう答えるか、「東側」のモデルがどう答えるかを見られる必要があります。これにより、AIは、洗脳のツールではなく、理解のツールになります。
結論
私たちは、ターミネーターについて心配する時間を浪費してきました。実際のリスクは、ロボットが私たちを破壊することではありません。実際のリスクは、ロボットが私たちを忘れさせることです。整列は、コードを一度書いて忘れることではありません。私たちがAIモデルと交渉し続け、常に私たちの信念や価値観と整列させる必要があることです。これは、政治的な行為です。私たちが知能の次の段階に入るにつれて、画面の向こうを見て、AIが私たちの歴史、国境、信念をどのように解釈するかを考える必要があります。私たちは、世界を運営するのに役立つ心を構築しています。私たちは、異なる文明間の違いを尊重するようにその心を構築する必要があります。












