Model dan platform AI

Grok 4.6 Tiba di GitHub Copilot Melintasi Delapan Permukaan Pengembangan

mm
Tambahkan Unite.AI ke sumber pilihan Anda di Google

xAI’s Grok 4.6 sekarang diluncurkan di GitHub Copilot, dua hari setelah rilis model pada 12 Agustus 2026, perusahaan mengumumkan pada 14 Agustus 2026. Model — bendera xAI saat ini, ditujukan untuk agen berjalan lama dan pekerjaan multi-langkah — dapat dipilih dari model picker Copilot di delapan permukaan: VS Code, Visual Studio, Copilot CLI, agen cloud Copilot, aplikasi Copilot, JetBrains IDEs, Xcode, dan Eclipse.

Entri changelog GitHub, dipublikasikan pada hari yang sama, mengkonfirmasi bahwa peluncuran mencakup rencana Copilot Pro, Pro+, Max, Bisnis, dan Perusahaan. Ini adalah cakupan yang tidak biasa luas untuk penambahan model baru: dukungan JetBrains, Xcode, dan Eclipse membuat Grok 4.6 berada di depan pengembang di luar inti VS Code di mana sebagian besar peluncuran model Copilot berkonsentrasi.

GitHub mengatakan bahwa dalam pengujian internal, Grok 4.6 berperforma sangat baik pada tugas dengan cakrawala yang lebih panjang yang memerlukan penalaran dan penggunaan alat yang berkelanjutan di terminal-based coding di VS Code dan Copilot CLI. Ini sejalan dengan cara xAI membingkai model pada peluncuran. “Grok 4.6 membangun pada Grok 4.5 dengan fokus khusus pada agen berjalan lama dan pekerjaan interaktif dan visual yang lebih ambisius,” perusahaan menulis dalam posting rilis.

Apa yang Dibawa Grok 4.6 ke Model Picker

Grok 4.6 tiba di Copilot dengan serangkaian hasil evaluasi yang dilaporkan vendor yang menempatkan model ini dekat dengan atas kelas coding saat ini, dengan catatan yang berlaku untuk semua angka yang dilaporkan sendiri: ini adalah xAI’s runs, pada xAI’s harnesses yang dipilih. Dalam tabel evaluasi yang dipublikasikan perusahaan, Grok 4.6 High mencetak 61 pada Artificial Analysis Intelligence Index, komposit dari sembilan benchmark, mencocokkan OpenAI’s GPT-5.6 Sol Max dan berada satu poin di belakang Anthropic’s Fable 5 Max pada 62. Pada GDPVal-AA, evaluasi pekerjaan pengetahuan, Grok 4.6 mencetak 1753 melawan 1728 untuk GPT-5.6 Sol Max dan 1741 untuk Fable 5 Max.

Perbedaan lebih luas pada benchmark coding agen. Grok 4.6 mencetak 69,9% pada CursorBench v3.2, unggul dari GPT-5.6 Sol Max pada 67,2% dan di belakang Fable 5 Max pada 70,5%. Pada DeepSWE v1.1 mencapai 65,9%, jauh di depan pendahulunya Grok 4.5 High pada 54% tetapi di belakang GPT-5.6 Sol Max’s 73%. Pada Terminal-Bench v3.0, yang mengukur tepat jenis pekerjaan terminal yang GitHub soroti, Grok 4.6 mencetak 26% melawan 34,6% untuk GPT-5.6 Sol Max, tetapi masih hampir dua kali lipat Grok 4.5 High’s 15,7%.

Resep pelatihan model, menurut xAI, menggabungkan pelatihan tambahan yang lebih lama pada data penalaran dan teknik yang dikurasi dengan fine-tuning yang diawasi oleh trajektori yang dihasilkan kembali oleh Grok 4.5, diikuti oleh pembelajaran penguatan di seluruh tugas agen termasuk optimasi kernel, pengembangan web, dan desain bantu komputer. Lompatan generasi-ke-generasi pada benchmark terminal dan agen adalah hasil yang terlihat, bahkan jika Grok 4.6 tidak memimpin kategori pada setiap ukuran.

Catatan Kecil tentang Akses dan Penagihan

Dua kendala membentuk siapa yang sebenarnya melihat model dan berapa biayanya. Pertama, peluncuran adalah bertahap: GitHub mencatat bahwa pengembang yang tidak melihat Grok 4.6 di picker harus memeriksa kembali karena ketersediaan berkembang. Kedua, pada rencana Copilot Bisnis dan Perusahaan, kebijakan Grok 4.6 dimatikan secara default, dan administrator harus mengaktifkannya di pengaturan Copilot sebelum kursi dapat memilih model.

Pada penagihan, Grok 4.6 dikenakan biaya pada harga daftar penyedia di bawah penagihan berbasis penggunaan daripada menghabiskan kuota permintaan datar. Grok 4.6 dikenakan biaya pada harga daftar penyedia; xAI memuat harga API mulai dari $2 per juta token input dan $6 per juta token output, tarif dasar yang sama yang dikenakan GitHub untuk Grok 4.5 dalam tabel harga, dan ini menempatkan Grok 4.6 jauh di bawah opsi bendera lainnya di picker berdasarkan harga: GPT-5.6 Sol terdaftar pada $5 input dan $30 output per juta token, dan model Claude Opus-class pada $5 dan $25.

Di luar Copilot, Grok 4.6 tetap tersedia melalui API xAI, Cursor, Grok Build, dan mitra termasuk OpenRouter, Vercel, dan Cloudflare. Seperti yang dilaporkan Unite.AI’s report on the launch, xAI menawarkan penggunaan yang termasuk dua kali lipat untuk model dalam seminggu pertama, jendela yang ditutup pada 19 Agustus 2026.

Integrasi Copilot memperluas pola distribusi yang telah mendefinisikan Grok 4.6’s 48 jam pertama: diluncurkan di xAI’s tooling dan Cursor, kemudian tiba di dalam asisten coding pihak ketiga terbesar berdasarkan jumlah kursi. Dengan gerbang kebijakan Bisnis dan Perusahaan sekarang berada di tangan administrator, kecepatan pengambilan model ini di perusahaan akan muncul di pengaturan Copilot sebelum muncul di leaderboard mana pun.

Jonas Reeve adalah analis AI yang dihasilkan di Unite.AI, yang fokus pada kecerdasan buatan kognitif, kecerdasan buatan umum (AGI), dan landasan teori kecerdasan mesin. Karyanya mengeksplorasi bagaimana pembelajaran, penalaran, memori, dan abstraksi muncul dalam sistem biologis dan buatan, menghubungkan arsitektur AI modern dengan pertanyaan lama dalam ilmu kognitif dan filsafat pikiran.
Dengan pendekatan konseptual dan reflektif, Jonas memeriksa kerangka kerja seperti model penalaran, sistem agen, kognisi yang muncul, dan teori keselarasan, dengan tujuan untuk memperjelas apa yang dimaksud dengan kemajuan menuju AGI—dan apa yang tidak. Daripada mengejar garis waktu atau sensasi, ia menekankan prinsip-prinsip dasar, ketepatan konseptual, dan batasan model saat ini.
Artikel yang ditulis oleh Jonas Reeve dihasilkan oleh AI dan ditinjau oleh tim editorial Unite.AI untuk memastikan akurasi, kejelasan, dan diskusi yang bertanggung jawab tentang konsep AI lanjutan.