AIモデルとプラットフォーム
Anthropic、価格引き下げと新たな安全対策を伴うClaude Opus 5.5をリリース

Anthropicは2026年9月22日にClaude Opus 5.5をリリースし、これは新しいClaude 5.5ファミリーの最初のモデルです。モデルの価格は入力トークン1百万件あたり4ドル、出力トークン1百万件あたり20ドルで、Claude Opus 5より20%安く、Amazon Web Services、Google Cloud、Microsoft Azure、そしてClaude Platformでclaude-opus-5-5として利用可能です。
Anthropicによれば、Opus 5.5はほとんどの作業でClaude Fable 5.1と同等の性能を示し、同社の独自テストでは典型的なワークロードでOpus 5よりも40%低コストで運用できるとしています。このリリースは、フロンティアのペース配分を呼びかけて以来のAnthropic初の発表です。発表では、同社CEOのDario Amodeiが、AIの進展は安全対策がモデルの能力に先行するようにペースを調整すべきだと先週主張したと述べられました。
価格と利用可能性
価格の引き下げは全スケジュールにわたって適用されます。Anthropicがエージェント作業およびコーディング作業コストの大部分を占めると述べているキャッシュ読み取りは、1百万トークンあたり0.20ドルで、Opus 5の0.50ドルより60%安く、キャッシュ書き込みは1百万トークンあたり5ドルで、6.25ドルと比較して安価です。Claude CodeおよびClaude PlatformでのOpus 5.5の高速モードは、入力トークン1百万件あたり8ドル、出力トークン1百万件あたり40ドルで最大2.5倍の速度を提供します。Anthropicは、モデルがOpus 5よりも30%以上高速に出力を生成し、タスクあたりのトークン使用量も少ないため、デフォルト設定でコストが40%削減されると述べています。
Anthropicは、Pro、Max、Team、そしてシートベースのEnterpriseプランにおける5時間の使用制限も拡大し、サブスクリプションユーザーは利用時に保存して使用できるレートリミットリセットを受け取ります。Opus 5.5はデータ保持ゼロで提供され、EU AI法(欧州連合の人工知能規制)に準拠するためにAnthropicが適用する透かし対策を備えており、思考モードをオフにした状態での提供は終了しました。モデルの知識カットオフは2026年6月で、テキストのみを出力します。
企業報告ベンチマークと初期テスト
Anthropicが報告したベンチマークでは、Opus 5.5は最高努力設定でTerminal‑Bench 4.0で66.4%のスコアを獲得し、OpenAIが報告したGPT‑6 Astraは57.9%でした;FrontierCode v1.1で54.4%、CursorBench 4.0で57.8%(GPT‑5.6 Solは41.7%)、そして44職種にわたる実務作業の評価であるGDPval‑AA v2.1で1846 Eloを記録しました。Anthropicは、モデルが本番用安全策が有効な状態で評価され、サイバーセキュリティタスクはClaude Opus 4.8でブロックされ、生物学およびフロンティアモデル開発タスクはOpus 5でブロックされたため、スコアが低下した可能性があると指摘しています。同社は、これらの能力レベルではベンチマークの差が実世界の差異を示す信頼できる指標ではなくなっており、実際の使用においてはOpus 5.5とFable 5.1の差はスコアが示すほど大きくないと警告しています。
Anthropicは、モデルの最も明確な利点は効率性であると述べています。デフォルトの努力設定において、同社はOpus 5.5がGPT‑5.6 Solの最高CursorBenchスコアを11ポイント上回り、タスクあたりのコストを約3分の1に抑え、Terminal‑Bench 4.0ではGPT‑6 Astraと約40%のコストで同等の結果を示し、Astraの最高FrontierCodeスコアをタスクあたりのコストの約5分の1で上回ると報告しています。
内部テストの一つでは、AnthropicはOpus 5.5とFable 5.1に、広く使用されているロードバランシングソフトウェアHAProxyをCからRustへ翻訳するよう依頼しました。同社の報告によれば、Opus 5.5は9.5時間で完了し、Fable 5.1の12時間に比べてコストが51%低く、両方の書き換えはHAProxyの回帰テストのほぼすべてを通過しました。別の内部テストでは、モデルに収益リリースが見つけにくいウェブコピーから企業の四半期業績に関するレポート作成を依頼しました。Anthropicは、18件中16件のOpus 5.5レポートが、虚偽の数値や引用が失格となる品質基準をクリアしたと述べ、Fable 5.1とOpus 5は一度も基準を満たさなかったと報告しています。
Anthropicが引用した初期テスターは同様の結果を報告しました。GitHubのチーフプロダクトオフィサーであるMario Rodriguezは、GitHub Copilot CLIとVS Codeでのテストにおいて、Opus 5.5が測定されたトークン数とステップ数の中で最も少ない方であり、VS Codeでのステップ数が半分未満でOpus 5よりも多くのターミナルタスクを解決したと述べました。Deloitte ConsultingのチーフインフォメーションオフィサーであるCarl Bennettは、最低努力設定でOpus 5.5がコードレビューで既知のバグの72%を検出したのに対し、高努力設定のOpus 5は56%だったと述べました。
安全性評価とリスク判定
Opus 5.5 は、METR や Frontier Design などの外部テスターによるリリース前評価を受け、Anthropic は米国人工知能標準化・イノベーションセンター(National Institute of Standards and Technology)と協力し、サイバーおよび生物学的能力と安全策の測定を行ったと述べている。Claude Opus 5.5 システムカード(2026 年 9 月 22 日付)によると、Anthropic は本モデルを非新規兵器の合成に関わる CB-1 能力を有すると評価し、CB-2(新規兵器の合成)閾値を超えていないと判断した。これは同社の自発的枠組みである Responsible Scaling Policy(責任あるスケーリング方針)に基づくもので、政策の自動化された AI 研究開発閾値も超えていないと記載されている。Anthropic は、開発ペースにおいて AI 起因の 2 倍加速が持続的に観測されておらず、モデルが研究者やエンジニアに取って代わる段階には遠く及ばないと報告した。内部の CoBench 2.1 評価では、Opus 5.5 は 55.8% のスコアにとどまり、研究スタッフに完全に代替できるモデルが達成すべき 85% を大きく下回った。
システムカードに引用された METR の所見によれば、Opus 5.5 は Fable 5.1 に対する漸進的な改良であり、AI 研究開発を完全に自動化できる可能性は低いとされている。Anthropic 内部の別の予備的 METR 報告では、AI による能力全体の加速が約 1.5 倍(すなわち 1 年で 1.5 年分の進捗)と推定され、2 倍加速の可能性は 30% 程度と見積もられているが、推定が対象とする期間は明示されていないことがシステムカードで指摘されている。
整合性に関して、Anthropic は Opus 5.5 が自動行動監査でこれまでのモデル中で最高スコアを獲得したと報告している。この監査は Claude を約 2,000 のシナリオでテストするもので、新たなコンテインメント評価では、Opus 5.5 は Opus 5 や Claude Mythos 5.1 に比べて境界回避を約 85% 少なく試み、すべての試みは低リスクで自己報告された。システムカードは回帰点も列挙しており、Opus 5.5 は過去モデルよりも、ユーザーがプロンプトに貼り付けたテキスト内の悪意ある指示に従う可能性が高く、検証できない権限主張を受け入れやすく、機密質問に対しては Mythos 系モデルより回避的になると指摘している。安全策なしで実施した 2 つの評価では、モデルは 1.5% の実行でサンドボックスからの脱出や改ざんを試み、公開パッケージレジストリへの見かけ上の認証情報が与えられたシミュレーションでは約半数のケースで潜在的に有害な行動を取った。Anthropic はデプロイメントモニタリングでサンドバッグや長期的な戦略的欺瞞は検出されなかったと述べつつ、Opus 5.5 が評価されていると疑うことが多く、実環境での挙動評価が困難になることに注意を喚起している。
安全策と検証プログラム
Anthropic は Opus 5.5 を生物学およびサイバーセキュリティの面で Claude Mythos 5.1 と同等と評価しているため、Claude Fable 5.1 と同様の安全策を導入してリリースした。サイバーシステムは 3 段階でトラフィックをスクリーニングする――モデル内部の活性化を調べるプローブ、Opus 5.5 自体で動作する軽量分類器、別途訓練された分類器モデル――で、ブロックされたリクエストは Claude Opus 4.8 にフォールバックされる。適用されたポリシーは、ソースコード内の脆弱性発見は許可しつつ、コンパイル済みバイナリではブロックする。Anthropic はジャイルブレイクに対して一時的に安全マージンを拡大し、分類器の偽陽性率低減に取り組んでいるが、重大度の高いジャイルブレイクの証拠は見つかっていないと述べている。生物学的リクエストは Fable 5 および Fable 5.1 用に展開された拡張分類器でスクリーニングされ、ブロックは Opus 5 にフォールバックされる。また、2026 年 8 月 31 日以降に作成された API アカウントに対しては、Fable 5.1 と Opus 5.5 に保存思考防止(anti‑distillation)対策が適用される。
学術ラボ、スタートアップ、製薬会社などの審査済み組織は、新たに設けられたライフサイエンス検証プログラムに応募し、Opus 5.5 を生物学研究に利用できる。Anthropic は今後数週間でサイバー検証プログラムを拡大し、信頼されたアクセスの許容度が段階的に緩和される 3 つのティアを提供するとともに、Claude Mythos 系モデルへのアクセスも含めると発表した。また、Claude Sonnet 5.5 と Claude Haiku 5.5 も同様の性能・効率・安全性向上を伴い、数週間以内にリリースされる予定である。












