AIモデルとプラットフォーム

スペースXAIがGrok 4.6をリリース – ロングランニングエージェント向け

mm
Unite.AI を Google の優先ソースに追加

スペースXAI(旧xAI)は、2026年8月12日に、ロングランニングエージェントやより大胆なインタラクティブおよびビジュアルワーク向けに設計された新しいフラグシップモデル、Grok 4.6をリリースしました。モデルは、同日、Cursorコードエディターと会社のGrok Buildツールで利用可能になります。また、API経由でも利用可能で、入力トークン1ミリオンあたり2ドル、出力トークン1ミリオンあたり6ドルから始まる価格設定となっています。会社の発表によるといます。

Grok 4.6は、Grok 4.5を基盤にしており、会社のエージェントコーディングとナレッジワークへの取り組みをさらに推進しています。

Grok 4.6の機能

会社は、Grok 4.6を「複雑なタスクを多くのステップにわたって遂行するモデル」と説明しています。研究、コードベースの作業、または広範な製品アイデアを実際のアプリケーションの最初のバージョンに変換する場合など、モデルは自らテストと検証を行い、ビジュアルやインタラクティブなプロジェクトではGrok 4.5よりも優れたパフォーマンスを発揮しています。

この機能の向上は、Grok 4.5よりも長いサプリメンタルトレーニングに基づいています。スペースXAIは、推論と技術的な概念のためのキュレーションモデル生成データ、改良されたオプティマイザー、Grok 4.5によって再生成されたSFTトラジェクトリーを使用しました。トレーニングデータには、STEM、ソフトウェアエンジニアリング、ナレッジワークなどのドメインが含まれており、問題のあるトレースはモデルベースのチェックによって除外されました。モデルは、カーネル最適化、Web開発、コンピュータ支援設計などのドメイン固有の環境を含む、エージェント強化学習タスクの範囲でトレーニングされました。

ベンチマークレース

スペースXAIによると、Grok 4.6は、9つのベンチマークの複合であるArtificial Analysis Intelligence Indexで、OpenAIのGPT-5.6 Solと同等の61点を獲得しました。AnthropicのFable 5 Maxは62点、Grok 4.5 Highは56点でした。会社の評価テーブルは、個々のテストではより複雑な結果を示しています。

DeepSWE v1.1ソフトウェアエンジニアリングベンチマークでは、Grok 4.6は65.9%のスコアを獲得し、Grok 4.5の54%を上回りましたが、GPT-5.6 Sol Maxの73%には及ばなかった。Terminal-Bench v3.0では、26%のスコアを獲得し、Grok 4.5の15.7%から大幅に上昇しましたが、GPT-5.6 Sol MaxとFable 5 Maxの約34%には及ばなかった。GDPVal-AA v2ナレッジワーク評価では、フィールドをリードし、1753のスコアを獲得しました。CursorBenchとFrontierCodeでも向上しました。これらの数字は会社のもので、第三者モデルスコアは自己報告または公開結果から抽出されており、独立した評価によって確認されていません。

リリースは、市場の混沌とした部分に位置しています。Anthropicは、Opusシリーズをフロンティアインテリジェンスに向けて積極的な価格設定で推進しています。OpenAIのGPT-5.6ファミリーは、エージェントコーディングのインカムントです。スペースXAIの戦略は、生の能力だけでなく価格と配布を競うことです。1ミリオン入力トークンあたり2ドルという価格設定で、Grok 4.6は多くのフロンティアライバルを下回り、会社はGrok BuildとCursorで最初の1週間、開発者向けにモデル使用量を2倍に増やしています。CursorとGrok Buildのほか、OpenRouter、Vercel、Cloudflareなどのパートナーを通じても利用可能です。

モデル背後の新会社

Grok 4.6は、過去1年間で完全に再構成されたビジネスからの最も明確な製品声明です。

Grok 4.6は、スペースXAIの名前を最初から持つ最初のフラグシップモデルであり、その価格設定、パートナーディストリビューション、エージェントフォーカスは、GrokをXソーシャルネットワークの機能ではなく、開発者とエンタープライズプラットフォームとして位置付けていることを示しています。ssが過去1年間で完全に再構成された会社です。Grok 4.6は、スペースXAIの名前を最初から持つ最初のフラグシップモデルであり、その価格設定、パートナーディストリビューション、エージェントフォーカスは、GrokをXソーシャルネットワークの機能ではなく、開発者とエンタープライズプラットフォームとして位置付けていることを示しています。

エヴァン・マーサーは、Unite.AIのAI生成コラムニストであり、AIスタートアップ、ベンチャーキャピタル、および次世代のテクノロジー企業を形作る資金動向を取り上げています。彼の取材は、初期段階のイノベーション、資金フロー、およびAI企業が概念から世界的な影響力へと拡大する際に創業者や投資家が下す戦略的決定に焦点を当てています。
戦略的かつ分析的な視点から、エヴァンは資金調達ラウンド、市場の立ち位置、AIスタートアップエコシステム全体にわたる新興トレンドを調査しています。彼は、ベンチャーキャピタル、企業投資、公開市場が人工知能のブレークスルーとどのように交差するかを追跡し、短期的なハイプから耐久性のあるシグナルを切り離しています。
エヴァン・マーサーによって執筆された記事は、AIによって生成され、Unite.AIの編集チームによって、グローバルAI投資ランドスケープの正確性、コンテキスト、および責任ある報道を確保するためにレビューされています。