AIモデルとプラットフォーム

セレブラス、Qwen3-235Bを発表:AIのスピード、スケール、コストの新時代

mm
Unite.AI を Google の優先ソースに追加

セレブラス・システムズは、Qwen3-235Bを正式に発表しました。これは、131,000トークンのコンテキストをフルサポートする最先端のAIモデルで、推論、コード生成、企業規模のAIアプリケーションにおけるパフォーマンスの新しい基準を設定しています。現在、セレブラス・インフェレンス・クラウドで利用可能なこのモデルは、最先端のクローズドソース・モデルと同等の機能を提供しながら、30倍のスピードと10分の1のコストで動作します。 (CBRS )

リアルタイムAI推論がブレークスルー・スピードに到達

AI推論は歴史的に遅く、大きなモデルは複雑なクエリに応答するのに1分以上かかるとされていました。セレブラスはこのボトルネックを解消しました。独自のウェーハー・スケール・エンジン3(WSE-3)によって動作するQwen3-235Bは、1,500トークン/秒を達成し、最先端のAI推論の世界記録を樹立しました。

このレベルのパフォーマンスはユーザー体験を変革し、60〜120秒の待ち時間を0.6秒に短縮します。複雑な推論タスクや、リトリーバル・オーグメンテーション・ジェネレーション(RAG)などのマルチステップ・ワークフローを実行する場合でも同様です。アーティフィシャル・アナリシスによるベンチマーク結果によると、現在、オープンまたはクローズドを問わず、他のプロバイダーはこの推論スピードに匹敵するものはありません。

コンテキストの新しい基準:131Kトークンによるリアルワールド・アプリケーション

このリリースと同時に、セレブラスはモデル・コンテキスト・ウィンドウを32KからQwen3-235Bでサポートされる131Kトークンに拡大しました。このコンテキスト・サイズの飛躍により、モデルは大量のデータをインジェストおよび推論することができます。フル・コードベース、複数のドキュメント・リポジトリ、長文の技術文書などを網羅します。

32Kのコンテキストでは基本的な生成タスクが可能ですが、131Kのコンテキストでは本格的な開発が可能になります。AIは、数十のファイルを統合し、複雑な依存関係をリアルタイムで管理する深いコード・コラボレーターとして機能することができます。ソフトウェア・エンジニアリング、ドキュメント・アナリシス、科学計算などの企業向けユースケースに最適です。

セレブラスが異なる理由:ハードウェアがAIから地上に設計されている

コンピュータ・アーキテクト、AI研究者、システム・エンジニアのチームによって設立されたセレブラス・システムズは、生成可能なAIをスケールする課題を解決するために、根本的に異なるアプローチを取りました。GPUクラスタに頼るのではなく、セレブラスは独自のチップ、ウェーハー・スケール・エンジン3を中心にAI専用のスーパーコンピュータを構築しました。

このチップは業界で唯一無二です。ディナープレートほどの大きさで、数百万のAI最適化コアと、数十ギガバイトのオンチップ・メモリを備えています。コンピュートとメモリが隣接する設計により、従来のマルチGPUソリューションの待ち時間、帯域幅の制限、およびオーケストレーションの複雑さが解消されます。

セレブラスは、CS-3システムをクラスタリングすることで、トリリオン・パラメータ・モデルを容易に実行できるAIスーパーコンピュータを作成できます。分散コンピューティングの技術的負担を回避しながら、記録的な推論スピードと新しいハイ・コンテキスト機能を可能にします。

MoE効率が劇的なコスト削減を可能にする

Qwen3-235Bは、マルチプル・オブ・エキスパート(MoE)アーキテクチャを使用して構築されています。入力によって内部のエキスパートのサブセットのみをアクティブ化するモデル設計により、計算効率が大幅に改善されます。

これにより、セレブラスはモデルを、クローズドソースの代替品よりも大幅に安価な価格で提供できます。具体的には、入力トークン1ミリオンあたり0.60ドル、出力トークン1ミリオンあたり1.20ドルで推論が利用可能です。OpenAI、Anthropic、またはGoogleのプロプライエタリ・モデルと比較して、コストが90%以上削減されます。

VS CodeのClineとのシームレスな統合

Qwen3-235Bのスピードとリアルワールド・アプリケーションを示すために、セレブラスは、Clineとパートナーシップを結んでいます。Clineは、現在180万以上の開発者がインストールしている、Microsoft Visual Studio Code内のリーディング・エージェント・コーディング・エージェントです。

Clineユーザーは、すでに64Kのコンテキストを備えたQwen3-32Bを無料プランの一部として利用できます。今日の発表により、サポートはQwen3-235Bとその131Kのコンテキストを含むように拡大され、以前は実現不可能だったリアルタイムの推論とコード生成が可能になります。

サウド・リズワン、ClineのCEOは、「セレブラスの推論を使用する開発者は、Clineが問題を推論し、コードベースを読み、コードをほぼリアルタイムで書く未来の姿を見ている。すべてが非常に速く進行するため、開発者はフローを維持し、思考のスピードで反復する。推論が速いことは、AIが開発者と真正に同期するときに何が可能になるかを示すものであり、単に便利な機能ではありません。」と説明しています。

クローズド・モデルに対するオープン・アльтルナティブ

Qwen3-235Bのパフォーマンスは、現在市場で利用可能な最も洗練されたAIモデル、Claude 4 Sonnet、Gemini 2.5 Flash、DeepSeek R1と同等であり、独立したベンチマークによって検証されています。ただし、セレブラスはこれをオープン・アクセス・フォーマットで提供し、クローズド・モデルが欠如している透明性と移植性を提供します。

このオープン・モデル・アプローチにより、企業は次のことができます:

  • 独自のデータでカスタマイズおよびファインチューン
  • プライベート・インフラストラクチャまたはハイブリッド・クラウド・環境にAIを展開
  • ベンダー・ロックインとデータ・プライバシー・リスクを回避

セレブラスのスケーラブル・クラウド・プラットフォームと、オプションのCS-3システムのオンプレミス・デプロイを組み合わせて、組織はミッション・クリティカル・タスクにAIを適用する方法を完全に制御できます。

これが業界に与える影響

Qwen3-235Bのリリースは、ターニング・ポイントを示しています。セレブラスは、最先端の知能と前例のないスピードとコスト効率を組み合わせることで、大規模な言語モデルで可能な限界を再定義しました。

これで、次のことが可能になりました:

  • 開発者のクエリにリアルタイムで応答するAIツール
  • フル・ドキュメントまたはナレッジ・ベースを推論する
  • IDE内で生のプロダクション・レベルのコードを生成およびデバッグ
  • GPUスプロールや6桁の毎月の推論料金なしで企業規模のユースケースに拡張

AIインフラストラクチャの需要が増加するにつれて、セレブラスは、パフォーマンス、価格、オープン性の妥協は必要ないことを実証しています。ウェーハー・スケール・エンジンからセレブラス・インフェレンス・クラウドまで、ハードウェアとソフトウェアの共同設計は、AIの展開の新しいモデルを示唆しています。より速く、よりシンプルで、よりアクセスしやすいモデルです。

最終的な考え

セレブラス・システムズは、Qwen3-235Bを131Kのコンテキスト、超高速の推論、そしてアクセスしやすいトークン価格でリリースしました。GPU駆動のインキュバントに真正に挑戦できる唯一の企業の1つとして自己を位置付けています。企業、研究者、開発者にとって、このリリースは、単に高速なモデルではなく、リアルタイム、プロダクション・グレード、オープンなAIを手に入れるための転換点です。

アントワーヌは、Unite.AIのビジョナリーレーダーであり共同創設者です。彼は、AIとロボティクスの未来を形作り、推進するための不屈の情熱に駆り立てられています。シリアルエントレプレナーである彼は、AIが電気と同様に社会に大きな変革をもたらすと信じており、破壊的な技術とAGIの可能性について語ることがよくあります。

彼はフューチャリストとして、これらのイノベーションが私たちの世界をどのように形作るかを探求することに尽力しています。さらに、彼はSecurities.ioの創設者であり、未来を再定義し、全セクターを再構築する最先端技術への投資に焦点を当てたプラットフォームです。