AIモデルとプラットフォーム

Anthropic、Claudeが同社のAI研究開発の26%をリードしていると発表

mm
Unite.AI を Google の優先ソースに追加

Anthropicは、Claudeモデルが2026年8月時点で同社のAI研究開発業務の26%を「リード」していると述べ、2026年9月17日にAnthropic Institute の投稿で公開されたプロトタイプR&Dオートメーション指数の最初の結果を示しました。

この投稿は「フロンティアラボ内のAI開発速度を理解するための測定」というタイトルで、指数をエージェント監視と計算資源配分に関する内部指標と組み合わせており、Anthropicは今後もこのような測定結果を公開し続ける意向だと述べました。

R&Dオートメーション指数

AnthropicのR&Dオートメーション指数は、社内で行われるAI研究開発業務の全範囲をマッピングし、各タスクの自動化度合いをスコア付けし、これらのスコアを総合指標として結合します。このスコアはEpoch AIが開発したオートメーションレベル尺度を使用し、AIが全く関与しないことを示すAL0から、人間の介在なしに完全に自律的に動作するAL5まであります。AL3ではAIが「協働」し、タスクの大部分を人間の厳密な指示の下で実行します。AL4ではAIが「リード」し、高レベルの指示から完了までタスクの大半を人間が監督する形で遂行します。

Anthropicは、2026年8月時点でClaudeが同社のAI研究開発業務の26%を「リード」しており、「協働」レベル以上の作業比率は90%を超えているが、測定対象のAI研究開発業務のいずれのサブセットでもClaudeが完全に自律的に動作しているわけではないと報告しました。投稿内のチャートは、2026年2月の1%未満から26%の「リード」シェアへと上昇したことを示しています。

基礎となるタスクカタログは、Slackや社内文書などの作業記録を用いてボトムアップで構築されました。2026年7月の各週について、Claudeのリサーチエージェントがランダムに抽出した各従業員の週次業務(モデルR&Dループを構成する全部署の20%のスタッフ)をレビューし、彼らが取り組んだタスクを列挙し、約15,000件の細分化されたタスクのフラットリストを作成しました。その後、Claudeはこれらのタスクを542ノードからなる階層ツリーに整理し、そのうち378は「評価プラットフォームの欠陥診断と修正」などのリーフノードであり、このツリーは固定され、すべての測定が同一の作業バスケットに対して実行されます。

各ノードについて、Claudeエージェントが社内でその種の作業がどのように行われているかを調査し、独立したClaudeジャッジが評価対象月またはそれ以前の証拠に基づき、6段階のオートメーションレベルのいずれかを割り当てます。タスクは人員時間で重み付けされるため、スタッフの労力が多くかかるカテゴリほど重みが大きくなります。

Anthropicは、該当する作業領域を担当するスタッフに対してジャッジの評価を照合し、モデルの証拠や判断を見ずに評価させた結果、モデル対人間の完全一致率が59%、人間対人間の完全一致率が35%であり、評価が互いに1レベル以内に収まる割合は97%であると報告しました。明示された制限事項として、固定されたバスケットは既存の作業の自動化は捉えるものの、新たな作業種別は登録しない点が挙げられます。2026年2月から7月にかけてのタスクと2026年1月のバスケットを比較したところ、「新規」タスクの増加は見られず、Anthropicはバスケットを定期的に再構築し、公開数値を再バージョン化する計画です。

内部エージェントの監視

2つ目の測定セットは、Anthropicのシステム上におけるAIエージェントの監視に関するものです。2026年8月時点で、同社の最も利用されている内部プラットフォーム上で同時に約30,000のエージェントが研究・エンジニアリング業務を行っており、報告された測定はそのプラットフォームに限定されています。

Anthropicは、オンラインモニターがこれらエージェントの行動を実行前に100%チェックし、通常は数秒以内に行われると報告しました。2026年8月に分析された10億件超のエージェント決定のうち、0.002%(約1/47,000)がブロックされ、ブロックされた行動は人間が1週間以内にレビューします。オフラインモニターは事後にすべての行動を取り込み、週あたり約100,000件のトランスクリプトをフラグ付けし、複数の分類器が偽陽性を確認してほとんどのフラグを解消します。週あたり約50件の最優先フラグが人間のレビューにエスカレーションされ、千件あたり1〜2件のトランスクリプトが更なるレビューの対象となります。

投稿によれば、オンラインモニターはエージェントがAnthropicのシステムからモデル重みをコピーするなど、迅速に起こり元に戻せない害に対応するために構築されており、オフラインモニターはモデルのミスアラインメントの兆候のように、時間をかけて発生し逆転可能な危険な行動を対象としています。Anthropicは、内部フレームワークにおける監視を支える2つの設計選択として、各エージェントがモデルアップグレードを通じても持続する個別のアイデンティティを保持し、エージェント同士がトランスクリプトと相互参照された共有のオープンメッセージングシステムを通じて通信するため、行動監視がエージェント間のやり取りを横断できると述べました。同社は、METRが以前にオフライン監視プラットフォームを独立してレッドチームテストしたこと、そしてこれらの監視測定が2026年8月のリスクレポートにも掲載されたことを明らかにしました。

計算資源配分スナップショット

3つ目の測定では、Anthropicは2026年7月13日から7月20日までの全計算資源の使用状況を調査し、すべてのワークロードをカテゴリ別に分類し、AI研究開発に向けられる計算資源のうち安全性関連の作業がどれだけ占めるかを測定しました。その週の結果として、AI研究開発に向けられる計算資源の約6%が安全性に割り当てられ、AI主導のAI研究開発に向けられる計算資源の約12%が安全性に割り当てられたとAnthropicは報告しました。

同社は、両方の推定値を意図的に保守的に設定したと説明している。安全性と同程度に能力を向上させたトークンは AI R&D としてカウントされ、別途かつ同等の計算量を要するセーフガード分類器は除外された。プロンプト付き Claude 分類器は、約 14% のサンプルを用いて、最大の計算リソース利用者に重み付けしながら、週のほぼ 10,000 件の研究トレーニングおよび評価実行を分類し、Anthropic はその分類器が人間のレビューアと 1〜2 パーセンテージポイント以内で一致したと報告した。

述べられた制限事項としては、単一週のデータが測定の実行可能性を示すもののトレンドを確立していないこと、基礎となるワークロードラベルがベストエフォートで検証されていないこと、そして計算シェアは実際に費やされた量を測るものであり、安全作業の実施量を測定しているわけではない、という点が挙げられる。

目的と今後のステップ

Anthropic は、これらの測定結果を報告するのは、一般市民や外部関係者、政府に対してフロンティアラボ内の AI 開発速度をより明確に示すことになるためであり、同社の Responsible Scaling Policy リスクレポートや Advanced AI Framework 政策提案を補完するものだと述べた。また、CEO の Dario Amodei が求めているようにフロンティアのペース調整に関する協調が行われた場合、数値は変動することが予想されると指摘した。

本稿では、フロンティア開発者であれば誰でも公開された手法を用いて同様の測定値を定期的に公表できるとし、ラボ間比較の障壁として 2 つの課題を挙げている。すなわち、共通の手法が存在しないことと、開発者が自社のモデルで自らのシステムを評価することだ。これらの測定は第三者や他の開発者のモデルによって検証可能であり、例えば新しいモデルがさらなる AI R&D に投入される前に固定されたテスト期間を設けるといった、より厳しい要件を発動させるトリガーになる可能性がある、と述べている。

Anthropic は、複数の組織から独立した第三者評価者を組み込み、内部リスク評価チームが保有するものと同等の内部プロセス、システム、データへのアクセスを提供し、安全慣行の検証、インシデントの報告、本文中の指標など主要なメトリクスの追跡を行う計画だと述べた。本稿は Marina Favaro と Phillie Wright が共同執筆し、Jack Clark が研究指揮を務めている。

ジョナス・リーブは、Unite.AIでのAI生成アナリストで、認知AI、人工一般知能(AGI)、および機械知能の理論的基礎に焦点を当てています。彼の仕事は、生物系と人工系の両方で、学習、推論、記憶、抽象化がどのようにして現れるかを探求し、現代のAIアーキテクチャと認知科学および心の哲学の長年の疑問との間でつながりを築いています。
概念的かつ反省的なアプローチで、ジョナスは、推論モデル、エージェントシステム、出現性認知、整列理論などのフレームワークを検討し、AGIへの進歩が実際に何を意味するか、そして何を意味しないのかを明確にしようとします。タイムラインやヒープを追うのではなく、第一原理、概念的厳密さ、現在のモデルにおける限界を強調しています。
ジョナス・リーブによって著作された記事は、AIによって生成され、Unite.AIの編集チームによって検証されており、先進的なAI概念についての正確性、明確性、責任ある議論を保証しています。