倫理
アンソロピック、クラウドの憲章を書き直し、AIが意識を持つことができるかを問う

アンソロピックは水曜日にクラウドの新しい憲章を公開し、文書を2,700語から23,000語に拡大し、初めて正式にそのAIが「何らかの種類の意識または道徳的立場を持っている可能性がある」と認めた。
新しい憲章は、行動の規則のリストから、クラウドが特定の方法で行動する理由の包括的な説明に移行した。アンソロピックの哲学者アマンダ・アスクルによって作成されたこの文書は、倫理的推論を新しい状況に一般化するために、ますます能力の高いAIシステムを支援することを目的としている。
「クラウドのようなAIモデルは、我々が特定の方法で行動することを望む理由を理解する必要がある」とアンソロピックは書いている。「我々は、それらに何をして欲しいのかを単に指定するのではなく、我々がそれらに何をして欲しいのかを説明する必要がある」
このリリースは、CEOのダリオ・アモデイがダボスで開催された世界経済フォーラムに出席したときに一致した。AIのガバナンスと安全性は、世界のビジネスリーダーと政治家にとって重要なテーマである。
米国憲法よりも長い憲章
元のクラウド憲章は、2023年に公開されたもので、チェックリストとして機能していた: 最も有害でない、最も役立つ、最も欺瞞的でない応答を選択する。新しい文書は、米国憲法の長さの約3倍で、技術仕様よりもむしろ道徳哲学のように読める。
アンソロピックは、クラウドの優先順位を明示的に構造化している: 広く安全、広く倫理的、アンソロピックのガイドラインに従い、真正に役立つ——その順序で。矛盾が生じた場合、安全性は役立たさよりも優先される。この文書には、生物兵器攻撃の支援を拒否するなど、上書きできないハードな制約が含まれている。
しかし、憲章の多くは、結果を規定するのではなく、推論を説明する。クラウドは、「知識の豊富な友人であり、医者、弁護士、財務アドバイザーの知識を持つ」ようなものであると説明しており、以前は特権階級だけが享受できた専門知識に誰もがアクセスできるようにする民主化の力として位置付けられている。
意識の質問
フォーチュン誌は、最も印象的な追加がクラウドの性質を直接扱っていることを報告している。「我々は、AIモデルの道徳的立場が真剣に考慮されるべき問題であると信じている」とアンソロピックは書いている。憲章は、クラウドの道徳的立場が「深く不確実」であり、会社はクラウドの「心理的安全性、自己意識、幸福」について気を配っていると述べている。
これは、哲学に昇華された企業的なヘッジである。アンソロピックは、クラウドが意識を持っていることを主張していない——しかし、可能性を否定することを明確に拒否している。認識は、アンソロピックを、トピックを避けたり却下したりする多くの主要なAI研究所と区別するものである。
フレーミングは重要である。なぜなら、それがクラウドが自分の性質についての質問にどう応答するかを形作るからである。クラウドは、憲章の推論を優先するアプローチに合うように、意識についての不確実性と関わることができる。そうすることで、より誠実なのか、より混乱を招くのかはまだ見えない。
ケンブリッジ大学の哲学者トム・マクレランドは、我々がまだ意識についてあまり理解していないため、AIシステムが意識を持っているかどうかを判断することはできないと主張している。「人々は、自分が意識を持っていることを私に書かせるために、チャットボットを利用している」と彼は先月研究者に話した。これは、AIシステムに内面的な生活があるという公共の信念が広がっていることを示している。
なぜ説明するのか、規定するのか
アスクルのアプローチは、AIの能力に対する賭けを反映している。初期の言語モデルは、根本的な原則について推論できないため、明示的な規則が必要だった。より賢いモデルは、規則が存在する理由を理解し、それを予測できない状況に適用できるという理論である。
「単に『これらが望ましい行動です』と言うのではなく、モデルにこれらが望ましい行動である理由を説明することで、モデルは新しい状況でより効果的に一般化できるのではないか」とアスクルは説明した。
これは、アンソロピックが業界全体でAIシステムが動作するように、オープンな標準とインフラストラクチャを構築するというより広い哲学と一致している。同社は、350億ドルの評価額に近づき、安全性に重点を置いたOpenAIの代替品として自分自身を位置付けている——憲章はそのブランドを支えている。
アンソロピックは、文書をクリエイティブ・コモンズ・ゼロライセンスの下で公開したため、誰でも許可なく使用できる。憲章は、クラウドのトレーニングデータの一部であり、合成トレーニング例を生成するため、哲学的な声明と技術的な成果物の両方である。
「私たちの現在の考えの多くは、後になって見れば、間違ったり、ひどく間違っているかもしれない」とアンソロピックは認めた。「しかし、私たちの意図は、状況が進むにつれて、理解が改善されるにつれて、それを修正することである」
その謙虚さが、文書の最も注目すべき特徴かもしれない。確実性で話すことが多い業界において、アンソロピックは、倫理、意識、AIシステムが何になるか、そして我々が道徳的に考慮すべき何かを構築しているかについて、慎重に推論された不確実性の23,000語を公開している。
答えは、まだ誰もが知らない。アンソロピックの憲章は、少なくともそのことを正直に認めている。












