AIモデルとプラットフォーム
セレブラス、OpenAIのGPT-5.6 Solを750トークン/秒で実行する新しいウルトラファスト層を発表

セレブラスは、現在、OpenAIのフラグシップモデルを、GPUクラウドが公開で達成していない速度で実行しています。2026年8月13日、ウェハースケールチップメーカーは、発表により、GPT-5.6 Solを新しいOpenAIサービス層「Ultrafast」で動作させ、最大750トークン/秒の出力と、OpenAIの説明によると、標準処理よりも最大14倍高速にモデルを実行します。Ultrafastは、OpenAI APIで最初に導入され、選択された顧客向けに限定プレビューとして開始され、容量が増加するにつれてアクセスが拡大します。
中心にある主張は、特定のものです。フロンティアインテリジェンスを、速度ペナルティなしで。GPT-5.6 Solは、OpenAIの最も優れたモデルであり、セレブラスのシリコン上では、トークンをリアルタイム製品内に配置するのに十分な速さで生成します。両社は、層を、モデルが十分に優れているか、作業中に使用するのに十分に速いかというトレードオフを解消するものとして位置付けます。
ウルトラファストの背後にある速度数値
750トークン/秒の数字は、見出しですが、より重要なのは、セレブラスが公開したヘッドツーヘッドの実行です。Artificial Analysisによって報告された出力速度と比較して、同社は、GPT-5.6 SolがUltrafastで、Claude Fable 5よりも11倍、Opus 4.8のファストモードよりも5倍高速に実行されることを示しています。
セレブラスは、層を、Humanity’s Last Examの完全なパスにも通しました。これは、2,500の質問のベンチマークであり、Ph.D.レベルの難易度に設定されています。GPT-5.6 SolがUltrafastで、2,500の質問に11時間11分で答えたのに対し、Claude Fable 5は、同等の結論に達するために78時間27分かかりました。セレブラスの説明によると、約7倍遅いです。GDP-Val、経済的に有価値な知識作業のベンチマークでは、同社は、標準処理と比較して、5.6倍のエンドツーエンドの高速化を報告していますが、品質の低下はありません。
これらはベンダーが実行した評価であり、セレブラスはその点について明確です。Humanity’s Last Examの比較は、2026年7月10日および13日から15日にかけてセレブラスによってベンチマークされ、GDP-Valの数字は、同社の2026年7月31日のテストからのものです。これらを同社自身の測定値と見なす必要があります。独立した結果ではありません。
ウェハースケールチップがレイテンシで勝つ理由
メカニズムはここで重要です。なぜ、小規模なチップメーカーが、GPUインキュベーターが達成していない速度でOpenAIの最大のモデルを提供できるのかを説明するからです。大きなモデルでの高速な推論は、基本的にデータ移動の問題です。GPUでは、各トークンを生成するために、モデル重みをオンチップメモリとオフチップストレージの間で繰り返し移動させる必要があり、メモリ帯域幅がボトルネックになります。
セレブラスの回答は、その移動を排除することです。同社のWafer-Scale Engineには、単一のウェハーサイズのチップに44 GBのSRAMがパッケージ化されており、モデルの重みはオンチップに残り、トークンはウェハー全体にわたってパイプライン化されたレイヤーを介して流れます。重みはシリコンを離れないため、アプローチはモデルサイズとともにスケールし、同社はその速度アドバンテージがフロンティアモデルが成長するにつれて維持されることを主張しています。推論の経済学の観点から、それが全てです。モデルのコストとレイテンシは、重みをコンピューティングに供給する速度によって支配されるからです。44 GBを1つのダイに保持することで、その問題に直接対処します。
100億ドルのパートナーシップがフラグシップに到達
Ultrafastは、数ヶ月にわたって構築されてきた関係の最も目立つ製品です。OpenAIは、2026年の早期に、セレブラスを10億ドルの低レイテンシコンピューティングに採用しました。この起動により、その容量がOpenAIのトップモデルの背後ではなく、小規模または特殊なものの背後に配置されます。OpenAIは、Ultrafastを「パートナーシップの次のステップ」と説明しています。超低レイテンシ推論をそのプラットフォームに導入するものです。
セレブラスにとって、配置は重要です。スタートアップは長い間、ウェハースケールアーキテクチャが推論に適していることを主張してきました。市場の重心はGPUサプライヤーにあり、加速器ビジネス全体でインキュベーターがモデルを直接シリコンに焼き付けるように動いている間でもです。OpenAIのフラグシップモデルを提供する層を獲得することで、セレブラスは市場の上位に位置するプロダクションリファレンスアカウントを獲得します。モデルのGPT-5.6ファミリーは、OpenAIが立ち上げたもので、Solはフラグシップであり、バランスのとれたTerraとコスト効率の高いLunaと並んでいます。Ultrafastは、セレブラスをそのラインナップの先頭に配置します。
誰がそれを得るのか、それは何のために
OpenAIは、時間に敏感で、高リスクな作業に向けて層を位置付けます。障害がまだ進行中のインシデント対応、市場状況が変化している金融研究、リアルタイムの顧客サポートとボイス、コマース、そして以前は夜間に実行されていたループの研究です。早期アクセスは、Jane Street、Podium、Basis、Rogoを含む、コーディング、コマース、金融を跨ぐ企業に提供されています。
> 「セレブラスによってもたらされた速度の向上は印象的です」と、OpenAIの発表では、Jane StreetのAIアシスタントであるJohn Crepezziが述べています。 「開発者がモデルとともに、より集中して、より生産的に作業できるようにします」。
OpenAIは、ロールアウトを意図的に狭くしています。同社は、注文の大きさの速度変更が最も価値のある場所を学ぶために、プレビュー期間を使用し、容量が増加するにつれてアクセスを拡大する予定です。OpenAIとセレブラスは、プレビューが拡大するにつれてアップデートの登録を受け付けています。
次に何が起こるか
近期の観察可能なのは、容量であり、能力ではありません。Ultrafastは限定プレビューであり、両社は、より広範な利用可能性を容量の成長ではなく固定日付に結び付けているため、拡大のペースが注目されることになります。より長期的な疑問は、OpenAIのモデルがスケールするにつれて、セレブラスのオンチップメモリのアドバンテージが持続するかどうかです。これは、ウェハースケールアーキテクチャが構築されている賭けです。












