AIモデルとプラットフォーム
Anthropic、価格を変えずにClaude Sonnet 5.5をリリース

Anthropicは2026年9月28日にClaude Sonnet 5.5をリリースしました。これはClaude 5.5ファミリーの第2モデルです。このモデルはClaude Sonnet 5と同じ価格設定(入力トークン1百万あたり$2、出力トークン1百万あたり$10)を維持しており、Anthropicによれば、テストではタスクあたり最大30%コスト削減しながら、出力速度が30%以上速くなるとされています。
Anthropicはリリース発表で、Sonnet 5.5はより高速で低コストな補完モデルであり、Claude Opus 5.5は複雑な作業で慎重な判断が必要とされるケース向けに設計されていると説明しました。Anthropicによれば、Sonnet 5.5は明確に範囲が定まった日常的なタスク、バグ修正、そして洗練された文書、スライド、スプレッドシートの作成に最も強く、デザインに対する鋭い目も持っていると付け加えました。
Claude Sonnet 5.5は、Amazon Web Services、Google Cloud、Microsoft Azureを含むすべてのプラットフォームで利用可能で、モデルIDはclaude‑sonnet‑5‑5です。また、Opus 5.5およびSonnet 5と同様にデータ保持なしで提供されます。
報告されたベンチマーク結果
Anthropicは、エージェント型コーディング評価であるTerminal‑Bench 4.0において、Sonnet 5.5が70.6%のスコアを獲得し、Sonnet 5の10.3%に対し、Opus 5.5の掲載スコア66.4%はXhigh努力の結果を反映していると報告しています。FrontierCode 1.1のメインセットでは、Sonnet 5.5はMax努力で46.2%、Xhighで52.1%を記録し、Sonnet 5の42.4%、Opus 5.5の54.4%、OpenAIのGPT‑6 Solの49.3%と比較されます。報告されたCursorBench 4.0のスコアは、Sonnet 5.5が55.5%、Sonnet 5が34.1%、Opus 5.5が57.8%です。
知識作業評価において、同社はSonnet 5.5のGDPval‑AA v2.1スコアが1844で、Opus 5.5の1846(2ポイント下)およびSonnet 5の1449より約400ポイント上回っていると報告しています。また、AA‑Briefcase v1.1スコアは1811で、Opus 5.5の1822、Sonnet 5の1359と比較されます。発表では、ツール使用時のHumanity’s Last Examで64.5%、OSWorld 2.1で部分点80.1%、ツール未使用のChartography(視覚的チャート認識テスト)で61.6%を示しています。Anthropicは、Sonnet 5.5がスクリーンショットのみでPokémon Redに勝利した初のSonnetモデルであると述べています。
同社は、ベンチマークスコアはモデル能力の一側面しか捉えていないと警告し、社内テストおよび外部テスターのテストでは、Opus 5.5が持続的な判断を要する複雑でオープンエンドな作業において明らかに優れていると述べています。脚注では、Artificial Analysisがプレリリース展開でGDPval‑AAとAA‑Briefcaseを実行した際、構造化出力のバグがあり、これが修正されたため、むしろSonnet 5.5の性能が過小評価されている可能性があると記載されています。別の脚注では、OpenAIが最近GPT‑6 Solの画像理解バグを修正したことが述べられており、サードパーティのスコアにはまだ反映されていない可能性があります。
初期テスター結果
CodeRabbitのAI部門副社長David Lokerは、Sonnet 5.5は複雑度のレベル全体でSonnet 5より優れた判断力を示し、出力トークンを大幅に削減できると述べ、CodeRabbitは現在、シンプルおよび中程度のレビューをこのモデルに移行し、数週間以内にさらに拡大する計画だと語りました。Base44 AIエンジニアリングリードのGabriel Grinbergは、118件の実際のアプリ構築において、Sonnet 5.5が1構築あたり平均3.6回のイテレーションで、Opus 5の7.7回と比較して少なく、Base44が比較したすべてのモデルの中で最もツール呼び出しの失敗が少なかったと報告しました。
Slackの主任エンジニアCurtis Allenは、プロンプトを変更せずにオフラインのSlackbot評価で出力トークンが約14%減少したと報告しました。ZendeskのAIディレクターAbhinay Kathuriaは、Zendeskが本番で使用しているClaudeモデルに比べ、チケット処理が20%速くなったと述べました。Balyasny Asset Managementは、2,441件の金融タスクからなるプライベートスイートで、回答あたり約121,000トークンと、Sonnet 5の497,000トークンを比較しました。Boxは、総トークン数を12%削減し、結果が2.4倍速くなったと報告し、Atlassianは顧客がRovo AgentsをSonnet 5に比べ最大30%速く実行できると述べました。
価格、速度、移行
Sonnet 5.5の掲載価格はSonnet 5と全く同じで、入力トークン1百万あたり$2、出力トークン1百万あたり$10、キャッシュ読み取りトークン1百万あたり$0.20、キャッシュ書き込みトークン1百万あたり$2.50です。Opus 5.5は入力$4、出力$20、キャッシュ書き込み$5と掲載しています。Anthropicは、同じ作業に対してSonnet 5.5ははるかに少ないトークンで済み、これまでで最も高速なSonnetモデルであると述べています。
このモデルは、low、medium、high、xhigh、maxの5つの再調整された努力レベルを提供します。デフォルトはClaude CodeおよびClaudeアプリではMedium、Claude PlatformではHighとなっており、これがAPIのデフォルトでもあります。
Anthropic の 移行ガイド では、Sonnet 5 から移行する開発者向けの破壊的変更が一覧化されています。適応的思考はデフォルトで有効になり、思考設定を無効にすると 400 エラーが返され、思考をオフにした状態で Sonnet を実行していた開発者は、移行前に新しい betweenツール設定、利用可能な最小の設定、移行前に。強制ツール選択は自動ツール選択(厳格ツールと組み合わせ)に置き換えられ、キャッシュ可能な最小プロンプトは Sonnet 5 の 1,024 トークンから 512 トークンに削減されます。ドキュメントには、サイバー、バイオ、フロンティア を含む 5 つの拒否停止理由カテゴリも一覧化されています。llm, reasoning抽出、そして一般ハーム、そしてサーバー側のフォールバックはサイバーと frontier_llm の拒否のみ再試行し、Sonnet 5 でそれらが減少すると記載されています。
安全性の調査結果と保護策
Sonnet 5.5 のサイバー機能が Opus 5 と同等であることから、Anthropic は同モデルが同社の最も高性能なモデルで使用されているサイバー保護とフォールバックを備えた初の Sonnet モデルであると述べました。システムカードによると、保護をオフにした場合、Sonnet 5.5 は平均 11.53 の機能フラグを示し、ExploitBench で 80% の捕捉率を達成、任意コード実行エクスプロイトを 178 件生成しました(Sonnet 5 は 1 件)。CyScenarioBench の課題は 46.1% をクリアし、Sonnet 5 の 0.7% と比較され、Binary Exploitation Benchmark では制御フロー乗っ取りを 50 件生成しました(Sonnet 5 は 3 件)。
サイバー保護は 3 段階で実行されます:モデル内部の活性化に対するプローブ、軽量なオンモデル分類器、そして別途訓練された LLM 分類器です。カードはサイバー危害カバレッジセットで 99.43% のリコール率、リワインド攻撃者ロバスト性評価で 21.0% の攻撃成功率を示し、これは Sonnet 5 の 57.2% から改善されたものです。また、ユーザーには benign なサイバーセキュリティタスクでも拒否が増える可能性があると警告しています。リスクの高いリクエストは目に見えて Sonnet 5 にフォールバックし、拡張されたサイバー検証プログラムがまもなく、検証済みの防御者に Sonnet 5.5、Opus 5.5、Claude Mythos モデルの高度な機能への階層的アクセスを提供する予定です。
生物学的保護は Opus 5 に展開された有害誤用分類器と同一で、フォールバックモデルはありません。また、Anthropic のライフサイエンス検証プログラムは、生物学全領域の作業へのアクセスをカバーしています。Sonnet 5.5 は、推論抽出をブロックする安全分類器を備えた初の Sonnet モデルでもあり、モデルの思考がそれを作成したアカウントから切り離されないように、保存された思考を拡張しています。
Anthropic が約 1,850 のシナリオで実施した自動行動監査によると、Sonnet 5.5 は整合性、誤用耐性、誠実性のほとんどの指標で Sonnet 5 を上回るか同等であり、テストされたモデルの中で最も低いサンドボックス脱走試行率を記録し、多くの従来モデルよりも読解不能な思考を示しています。システムカードは、Sonnet 5.5 が新たな Responsible Scaling Policy の閾値を超えていないこと、同ポリシーの CB-1 および Autonomy-1 閾値を満たしているとみなされていること、そして壊滅的なミスアラインメントのリスクが低く評価されていることを示しています。モデルの信頼できる知識カットオフは 2026 年 6 月です。
Anthropic は、ボリュームが高くコスト感度の高いアプリケーション向けに構築された Claude Haiku 5.5 が、数週間以内に Claude 5.5 ファミリーに加わると発表しました。












