AIモデルとプラットフォーム

Anthropic、Claude Opus 5.5 の価格設定を長時間のコーディングセッションに結び付ける

mm
Unite.AI を Google の優先ソースに追加

Anthropicは2026年9月24日、過去6か月間にわたりClaude Codeセッションが長くなり、コンテキストが重くなったと報告し、Claudeブログの投稿でClaude Opus 5.5の価格設定とキャッシュ機構がこの変化にどのように対応しているかを詳述した。同社は、典型的なトークン課金ワークロードにおいて、Opus 5.5の運用コストがOpus 5より約40%低いと独自に見積もっている。

Claude Code使用データの6か月間

この記事はMichael Segnerが執筆し、2026年3月から9月までの集計使用データに基づいている。セッションあたりのプロンプト数は横ばいであったと記事は報告し、各プロンプト内の作業量は増加した。モデルはプロンプトごとに3.3倍長く動作し、各プロンプトでのモデル呼び出し回数が40%以上増加し、割り込みは68%減少した。開発者はツールサーバーに接続したりスキルを使用する頻度が約2倍になり、プロンプトへのテキスト貼り付けは3分の1減少した。

この期間中、各リクエストのコンテキスト量は2.6倍に増加し、入力トークンと出力トークンの比率は189:1から324:1へ変化した。Anthropicは、開発者がより長時間稼働し、情報量の多いモデルを、規模が大きく、よりオープンエンドなタスクに向けて使用しようとしていると解釈し、Opus 5.5によるコスト削減は、まさにそのような長く高コンテキストなセッションで最大になると述べている。

この分析はAnthropicがClaude Opus 5.5をリリースしたことに基づいており、Opus 5より低価格で提供された。価格設定が行われた後、9月24日の記事と、2026年9月22日にAddy Osmaniが公開した補足分析が、実際のClaude Codeワークロードにおいてこれらの価格が何を意味するかを検証している。

トークン価格とキャッシュ読み取りの削減

トークン課金の使用において、Anthropicは入力トークンと出力トークンの価格を20%削減し、キャッシュトークンの読み取り価格を60%カットした。同社は、キャッシュ読み取りの削減が最も重要であると述べており、キャッシュ読み取りがエージェント作業やコーディング作業のコストの大部分を占めるためだと説明する。また、公開時点でOpus 5.5のキャッシュトークンは競合モデルの5分の1のコストであり、性能面でも上回っていると述べている。

Osmaniの補足分析では、Opus 5.5のAPIリスト価格は入力トークン1百万件あたり4ドル、出力トークン1百万件あたり20ドル、キャッシュ読み取り1百万件あたり0.20ドルと示されている。これらの価格では、キャッシュ読み取りは新規入力トークンの5%のコストで済み、キャッシュへの書き込みは5分間のキャッシュで入力価格の1.25倍、1時間のキャッシュで入力価格の2倍のコストとなり、各ヒットで有効期間が無料で更新される。Pro、Max、またはTeamプランでは、Opus 5.5の低価格がプラン上限に反映され、Opus 5に比べ約25%多く利用できるようになる。追加のキャッシュ読み取り割引はAPI価格にのみ適用される。

キャッシュを保護する変更点の活用

リクエストごとのコンテキストが約2.6倍に増加したにもかかわらず、キャッシュにヒットしない入力の割合は6か月間で50%以上減少したと記事は報告している。これは、ログインリフレッシュといった小規模な中断や、会話途中で指示を追加したりツールをオンデマンドでロードするような大規模な中断を防ぐ、Claude Codeの一連の変更によるものと評価している。Opus 5.5およびFable 5.1では、開発者はセッション中にエフォートレベルを変更してもキャッシュをリセットする必要がなくなった。

公式プロンプトキャッシュのドキュメントでは、エフォートレベルの挙動はAPIキーまたはClaudeサブスクリプションで適用され、Amazon Bedrock、Google CloudのAgent Platform、Claudeアプリゲートウェイでは適用されず、さらにCLAUDECODEDISABLEEXPERIMENTALBETASフラグが設定されている場合や、組織がHIPAA構成を持つ場合にも適用されないと明記している。

APIキーやクラウドプロバイダーを使用する開発者は、現在1時間のキャッシュ有効期限を設定できるようになった。これはサブスクライバーが既に持っていた設定である。ドキュメントにはデフォルトが示されており、Claudeサブスクリプションのメイン会話はプラン使用量内で1時間、使用クレジット、APIキー、またはクラウドプロバイダーの場合は5分となっている。promptCacheTtl設定またはCLAUDECODEPROMPTCACHETTL環境変数が長い有効期限を選択し、両方の制御にはClaude Code v2.1.242以降が必要である。

フォークされたサブエージェントは、同じコンテキストを再処理するコストを払う代わりに、親セッションのキャッシュから開始するようになった。ドキュメントでは、フォークは親のシステムプロンプト、ツールセット、完全な会話履歴を引き継ぎ、開始リクエストは直接親のキャッシュから読み取ると説明している。

タスクあたりのターン数の削減

Anthropicは、Opus 5.5が他のモデルよりも少ないターンでタスクを完了できると報告している。記事によると、Zeta LabsはOpus 5に比べてタスクあたりのターン数とツール呼び出し回数が少なく、コストはほぼ半分で、最も難しいタスクを2倍の数完了したと記録している。

この記事は、このパターンがすべてのタスクに当てはまるわけではないと警告し、Osmaniの分析を引用している。”範囲が明確に定義されたタスクでは、両モデルともほぼ同じターン数で完了し、得られるのは価格削減だけである。ギャップはオープンエンドなタスクで最大になるはずで、モデルが誤ったアイデアに多くのターンを費やす可能性がある。”

Anthropicはまた、Opus 5.5がOpus 5に比べて出力速度が30%以上速いと報告している。この向上はトークン使用量やキャッシュヒット率を変えずに実現されており、記事ではClaudeが無人で作業する時間が増えるため、長時間実行時の待ち時間が短縮されると指摘している。

この記事は、キャッシュされた読み取りを保護するための実践で締めくくられます:Claude Code で /usage を実行して、セッションのどの程度がキャッシュから提供されているかを確認し、セッション開始時にモデルを選択して途中で切り替えないようにし、離れる前にコンパクションを実行し、API キーまたはクラウドプロバイダー上では、長時間のセッションのために 1 時間のキャッシュ有効期間を有効にします。

ジョナス・リーブは、Unite.AIでのAI生成アナリストで、認知AI、人工一般知能(AGI)、および機械知能の理論的基礎に焦点を当てています。彼の仕事は、生物系と人工系の両方で、学習、推論、記憶、抽象化がどのようにして現れるかを探求し、現代のAIアーキテクチャと認知科学および心の哲学の長年の疑問との間でつながりを築いています。
概念的かつ反省的なアプローチで、ジョナスは、推論モデル、エージェントシステム、出現性認知、整列理論などのフレームワークを検討し、AGIへの進歩が実際に何を意味するか、そして何を意味しないのかを明確にしようとします。タイムラインやヒープを追うのではなく、第一原理、概念的厳密さ、現在のモデルにおける限界を強調しています。
ジョナス・リーブによって著作された記事は、AIによって生成され、Unite.AIの編集チームによって検証されており、先進的なAI概念についての正確性、明確性、責任ある議論を保証しています。