AIモデルとプラットフォーム
OpenAI、GPT-5.6の2つの低コストモデルに対するAPI価格を引き下げ

OpenAIは、2026年7月30日に、GPT-5.6モデルの2つの低コストモデルに対するAPI価格を引き下げました。最も安いモデルは80%、中間モデルは20%引き下げられ、最高モデルは価格が据え置きとなりました。この変更は、同社のAPIの変更履歴に記載されており、公開された料金表にも反映されています。
1ミリオンの入力と出力トークンあたりの標準料金は、以下のようになりました。
- GPT-5.6 Luna: 20セントと$1.20、$1と$6から引き下げ
- GPT-5.6 Terra: $2と$12、$2.50と$15から引き下げ
- GPT-5.6 Sol: $5と$30、GPT-5.5の料金と同じまま
3つのモデルは、2026年7月9日に一般提供が開始され、当初の価格で提供されていました。価格変更は、提供開始から3週間後に実施されました。
価格変更は、ヘッドライン料金だけでなく、すべてのサービス階層に適用されます。バッチ処理とフレックス処理の料金は、標準料金の半額となり、Lunaの入力料金は10セント、出力料金は60セントとなりました。キャッシュされた入力読み取りの料金は、90%引き下げられ、Lunaでは2セント、Terraでは20セントとなりました。ロングコンテキスト要求の料金は、入力料金の2倍、出力料金の1.5倍となり、Lunaでは40セント、$1.80となりました。Amazon Bedrockを通じて購入する場合、AWSの料金が適用され、OpenAIの料金と異なる場合があります。
低コストモデルは、高容量の生産トラフィックに使用されます。分類、抽出、リクエストルーティング、初期ドラフト作成、長いエージェントループなど、1つのユーザー指示で何十もモデル呼び出しが発生する場合があります。低コストモデルの5倍の価格引き下げにより、自動化するための条件が変わります。
Claudeとの比較
Lunaの料金は、20セントと$1.20となり、Anthropicの最も安いモデル、Haiku 4.5の料金よりも、入力では5倍、出力では約4倍低くなりました。Anthropicの料金表によると、Terraの新しい料金は、Claude Sonnet 5の料金よりも低くなります。Solの料金は、Opus 5の料金よりも高くなります。
優先処理の廃止とFastモードの導入
同じ変更ログエントリで、優先処理が廃止され、Fastモードが導入されました。Solの場合、OpenAIは、Fastモードが標準速度の2.5倍まで高速化され、料金は2倍になることを示しています。Fastモードの料金は、Solの場合、$10と$60、Terraの場合、$4と$24、Lunaの場合、40セントと$2.40となります。
Anthropicも同様の製品を提供しており、Opus 5のFastモードの料金は、標準料金の2倍となります。2つの料金表は、地域固定の推論でも収束しています。OpenAIは、2026年3月5日以降にリリースされたモデルについて、データ居住性が必要な場合、10%の増加料金を請求します。Anthropicは、USのみの推論について、標準料金の1.1倍を請求します。
低コストモデルの価格引き下げの理由
OpenAIは、価格引き下げの1日前に、会計を公開しました。2026年7月29日のエンジニアリングポストで、5人の技術スタッフが、推論とエージェントハーネスに対する最適化について説明しました。Solは、Codex内で動作し、プロダクションGPUカーネルを書き直し、カーネルワークを組み合わせて、エンドツーエンドの提供コストを20%削減しました。Solは、推測的デコーディングのドラフトモデルを数百の実験で再設計し、トークン生成効率を15%以上向上させました。
これらは、OpenAIの自身の数字です。ポストは、ユーザーと顧客に「下層の改善を、より広く利用可能で、コスト効率の良いインテリジェンスの形で提供する」というコミットメントで終わりました。翌日、料金表が発表されました。
ハーネスワークは、価格引き下げの同じコストセンターを指しています。OpenAIは、ツールの出力を10,000トークンで制限し、モデル可視性の履歴を追加のみに保ち、エージェントループが毎回同じ指示とツール定義を送信する場合、プロンプトキャッシュにヒットし、フル入力料金を支払わないようにします。30のモデル要求があるタスクの場合、30回のチャンスがあります。
価格引き下げは、購入者が推論支出を監査し、モデルに触れるチームを拡大している間に実施されました。OpenAIの研究によると、従業員はChatGPTを職務名以外で使用しています。Amazonのエンジニアリング組織は、AIの支出を制限するために動いています。OpenAIは、2026年7月22日に、API組織とプロジェクトのためのハード支出制限を導入し、管理者が月間上限を設定できるようにしました。上限に達すると、エラーが返されます。
Lunaに大量の作業をルーティングしているチームの場合、同じ呼び出しは、以前の5分の1のコストで実行され、ダッシュボードで上限を設定できます。Solの価格は据え置きなので、OpenAIがファミリーを提供開始して以来、どの階層が必要かという判断は、同じままです。












