Model dan platform AI

SpaceXAI Meluncurkan Grok 4.6 untuk Agen Berjalan Lama

mm
Tambahkan Unite.AI ke sumber pilihan Anda di Google

SpaceXAI, perusahaan kecerdasan buatan yang sebelumnya dikenal sebagai xAI, merilis Grok 4.6 pada 12 Agustus 2026, model bendera baru yang dibangun untuk agen berjalan lama dan pekerjaan interaktif dan visual yang lebih ambisius. Model ini tersedia pada hari yang sama di editor kode Cursor dan alat Grok Build perusahaan, serta melalui API-nya, dengan harga awal $2 per juta token input dan $6 per juta token output, menurut pengumuman perusahaan.

Grok 4.6 membangun pada Grok 4.5 dan memperluas dorongan perusahaan ke dalam pengkodean agen dan pekerjaan pengetahuan.

Apa yang Dilakukan Grok 4.6

Perusahaan menjelaskan Grok 4.6 sebagai model yang “tetap dengan tugas kompleks di seluruh langkah”, apakah melakukan penelitian topik, bekerja di seluruh basis kode, atau mengubah ide produk yang luas menjadi versi pertama aplikasi yang berfungsi. Pada trajektori yang lebih panjang, perusahaan mengatakan bahwa mereka mengamati lebih banyak pengujian dan verifikasi diri, dengan model memeriksa pekerjaannya sendiri sebelum melanjutkan, dan lulus pertama yang lebih kuat pada proyek interaktif dan visual daripada yang mereka lihat dengan Grok 4.5.

Kemampuan keuntungan beristirahat pada pelatihan tambahan yang lebih lama daripada Grok 4.5. SpaceXAI menggunakan data model yang dihasilkan yang dikurasi untuk alasan dan konsep teknis, optimizer yang ditingkatkan, dan trajektori SFT yang dihasilkan kembali oleh Grok 4.5 di seluruh upaya alasan, harness agen, dan domain termasuk STEM, teknik perangkat lunak, dan pekerjaan pengetahuan, dengan jejak yang bermasalah difilter oleh model berbasis pemeriksaan. Model tersebut kemudian dilatih pada berbagai tugas pembelajaran penguatan agen, termasuk lingkungan domain-spesifik untuk optimasi kernel, pengembangan web, dan desain bantuan komputer.

Balap Benchmark

SpaceXAI melaporkan bahwa Grok 4.6 sesuai dengan OpenAI’s GPT-5.6 Sol pada Indeks Kecerdasan Analisis Buatan, komposit dari sembilan benchmark, dengan kedua model mencetak 61, di belakang Anthropic’s Fable 5 Max pada 62 dan di depan Grok 4.5 High pada 56. Tabel evaluasi perusahaan sendiri menunjukkan gambaran yang lebih campuran di seluruh tes individu.

Pada benchmark DeepSWE v1.1 perangkat lunak teknik, Grok 4.6 mencetak 65,9%, naik dari 54% Grok 4.5 tetapi tertinggal GPT-5.6 Sol Max pada 73%. Pada Terminal-Bench v3.0 mencapai 26%, lompatan besar dari 15,7% Grok 4.5 tetapi jauh di belakang sekitar 34% yang diposting oleh GPT-5.6 Sol Max dan Fable 5 Max. Ini memimpin lapangan pada GDPVal-AA v2, evaluasi pekerjaan pengetahuan, pada 1753, dan memposting keuntungan pada CursorBench dan FrontierCode. Angka-angka tersebut adalah milik perusahaan, dengan skor model pihak ketiga ditarik dari hasil self-reported atau publik yang tersedia, dan tidak ada evaluasi independen yang telah mengkonfirmasi mereka.

Peluncuran ini mendarat di bagian pasar yang sibuk. Anthropic telah mendorong lini Opusnya menuju kecerdasan frontier dengan harga agresif, dan keluarga GPT-5.6 OpenAI adalah target incumbent untuk pengkodean agen. Strategi SpaceXAI adalah untuk bersaing pada harga dan distribusi serta kemampuan mentah: pada $2 per juta token input, Grok 4.6 mengalahkan banyak saingan frontier, dan perusahaan menawarkan penggunaan ganda yang termasuk dalam Grok Build dan Cursor untuk minggu pertama untuk menarik pengembang ke model. Di luar Cursor dan Grok Build, juga tersedia melalui mitra termasuk OpenRouter, Vercel, dan Cloudflare.

Perusahaan Baru di Balik Model

Grok 4.6 adalah pernyataan produk yang paling jelas dari bisnis yang telah sepenuhnya direstrukturisasi selama setahun terakhir.

Grok 4.6 adalah model bendera pertama yang membawa nama SpaceXAI dari awal, dan harga, distribusi mitra, dan fokus agen menunjukkan divisi memposisikan Grok sebagai platform pengembang dan perusahaan daripada fitur dari jaringan sosial X.

Evan Mercer adalah koresponden yang dihasilkan AI di Unite.AI, yang meliput startup AI, modal ventura, dan dinamika pendanaan yang membentuk generasi berikutnya dari perusahaan teknologi. Laporannya berfokus pada inovasi tahap awal, aliran modal, dan keputusan strategis yang diambil oleh pendiri dan investor saat perusahaan AI berkembang dari konsep ke dampak global.
Dengan lensa strategis dan analitis, Evan memeriksa putaran pendanaan, posisi pasar, dan tren yang muncul di seluruh ekosistem startup AI. Ia melacak bagaimana modal ventura, investasi perusahaan, dan pasar publik berpotongan dengan terobosan di kecerdasan buatan, memisahkan sinyal yang tahan lama dari hype jangka pendek.
Artikel yang ditulis oleh Evan Mercer dihasilkan oleh AI dan ditinjau oleh tim editorial Unite.AI untuk memastikan akurasi, konteks, dan liputan yang bertanggung jawab dari lanskap investasi AI global