AIモデルとプラットフォーム

スペースXAIがGrok 4.6をリリース – ロングランニングエージェント向け

mm
Unite.AI を Google の優先ソースに追加

スペースXAI(旧xAI)は、2026年8月12日に、ロングランニングエージェントやより大胆なインタラクティブおよびビジュアルワーク向けに設計された新しいフラグシップモデル、Grok 4.6をリリースしました。モデルは、同日、Cursorコードエディターと会社のGrok Buildツールで利用可能になります。また、API経由でも利用可能で、入力トークン1ミリオンあたり2ドル、出力トークン1ミリオンあたり6ドルから始まる価格設定となっています。会社の発表によるといます。

Grok 4.6は、Grok 4.5を基盤にしており、会社のエージェントコーディングとナレッジワークへの取り組みをさらに推進しています。

Grok 4.6の機能

会社は、Grok 4.6を「複雑なタスクを多くのステップにわたって遂行するモデル」と説明しています。研究、コードベースの作業、または広範な製品アイデアを実際のアプリケーションの最初のバージョンに変換する場合など、モデルは自らテストと検証を行い、ビジュアルやインタラクティブなプロジェクトではGrok 4.5よりも優れたパフォーマンスを発揮しています。

この機能の向上は、Grok 4.5よりも長いサプリメンタルトレーニングに基づいています。スペースXAIは、推論と技術的な概念のためのキュレーションモデル生成データ、改良されたオプティマイザー、Grok 4.5によって再生成されたSFTトラジェクトリーを使用しました。トレーニングデータには、STEM、ソフトウェアエンジニアリング、ナレッジワークなどのドメインが含まれており、問題のあるトレースはモデルベースのチェックによって除外されました。モデルは、カーネル最適化、Web開発、コンピュータ支援設計などのドメイン固有の環境を含む、エージェント強化学習タスクの範囲でトレーニングされました。

ベンチマークレース

スペースXAIによると、Grok 4.6は、9つのベンチマークの複合であるArtificial Analysis Intelligence Indexで、OpenAIのGPT-5.6 Solと同等の61点を獲得しました。AnthropicのFable 5 Maxは62点、Grok 4.5 Highは56点でした。会社の評価テーブルは、個々のテストではより複雑な結果を示しています。

DeepSWE v1.1ソフトウェアエンジニアリングベンチマークでは、Grok 4.6は65.9%のスコアを獲得し、Grok 4.5の54%を上回りましたが、GPT-5.6 Sol Maxの73%には及ばなかった。Terminal-Bench v3.0では、26%のスコアを獲得し、Grok 4.5の15.7%から大幅に上昇しましたが、GPT-5.6 Sol MaxとFable 5 Maxの約34%には及ばなかった。GDPVal-AA v2ナレッジワーク評価では、フィールドをリードし、1753のスコアを獲得しました。CursorBenchとFrontierCodeでも向上しました。これらの数字は会社のもので、第三者モデルスコアは自己報告または公開結果から抽出されており、独立した評価によって確認されていません。

リリースは、市場の混沌とした部分に位置しています。Anthropicは、Opusシリーズをフロンティアインテリジェンスに向けて積極的な価格設定で推進しています。OpenAIのGPT-5.6ファミリーは、エージェントコーディングのインカムントです。スペースXAIの戦略は、生の能力だけでなく価格と配布を競うことです。1ミリオン入力トークンあたり2ドルという価格設定で、Grok 4.6は多くのフロンティアライバルを下回り、会社はGrok BuildとCursorで最初の1週間、開発者向けにモデル使用量を2倍に増やしています。CursorとGrok Buildのほか、OpenRouter、Vercel、Cloudflareなどのパートナーを通じても利用可能です。

モデル背後の新会社

Grok 4.6は、過去1年間で完全に再構成されたビジネスからの最も明確な製品声明です。

Grok 4.6は、スペースXAIの名前を最初から持つ最初のフラグシップモデルであり、その価格設定、パートナーディストリビューション、エージェントフォーカスは、GrokをXソーシャルネットワークの機能ではなく、開発者とエンタープライズプラットフォームとして位置付けていることを示しています。ssが過去1年間で完全に再構成された会社です。Grok 4.6は、スペースXAIの名前を最初から持つ最初のフラグシップモデルであり、その価格設定、パートナーディストリビューション、エージェントフォーカスは、GrokをXソーシャルネットワークの機能ではなく、開発者とエンタープライズプラットフォームとして位置付けていることを示しています。

Evan Mercer は AI 生成の特派員で、Unite.AI にて AI スタートアップ、ベンチャーキャピタル、次世代テクノロジー企業を形作る資金調達の動態を取材しています。彼の報道は、初期段階のイノベーション、資本の流れ、そして AI 企業が概念から世界的なインパクトへとスケールする際に創業者や投資家が行う戦略的な意思決定に焦点を当てています。

戦略的かつ分析的な視点で、Evan は AI スタートアップエコシステム全体の資金調達ラウンド、市場ポジショニング、そして新興トレンドを検証します。彼はベンチャーキャピタル、企業投資、公開市場が人工知能のブレークスルーとどのように交差するかを追跡し、短期的な誇大宣伝と持続可能なシグナルを区別します。

Evan Mercer が執筆した記事は AI 生成であり、Unite.AI の編集チームによってレビューされ、正確性、文脈、そして世界的な AI 投資環境の責任ある報道が確保されています