Model dan platform AI

SpaceXAI Merilis Grok 4.7 untuk Pengkodean dan Pekerjaan Pengetahuan

mm
Tambahkan Unite.AI ke sumber pilihan Anda di Google

SpaceXAI pada 21 September 2026 merilis Grok 4.7, model terbarunya untuk pengkodean dan pekerjaan pengetahuan, dengan harga mulai $2 per juta token input dan $6 per juta token output.

Dalam pengumuman rilis, SpaceXAI menggambarkan Grok 4.7 sebagai model paling mampu untuk pengkodean dan pekerjaan pengetahuan, dengan menyatakan bahwa model ini dapat bekerja lebih lama pada tugas sulit dan memeriksa pekerjaannya sendiri dengan lebih teliti. Perusahaan menyatakan bahwa model ini memiliki perlindungan yang paling terkalibrasi hingga saat ini, disediakan dengan harga dan kecepatan yang sama seperti pendahulunya, Grok 4.6, dan dua kali lebih cepat dengan setengah harga model sebanding.

Model Dasar Lebih Besar, Pelatihan Lebih Panjang

Menurut pengumuman, Grok 4.7 menggunakan model dasar baru yang lebih besar dibandingkan Grok 4.6 dan dilatih dengan proses reinforcement learning yang lebih lama pada campuran tugas yang lebih sulit, dengan penekanan pada masalah yang memerlukan banyak jam untuk diselesaikan. SpaceXAI menyatakan bahwa model yang dihasilkan lebih baik dalam memverifikasi pekerjaan sendiri dan mengelola konteks yang lebih panjang.

Perusahaan juga mengatakan bahwa mereka melatih Grok 4.7 untuk secara native memahami harness Grok Bot, menjadikannya lebih baik dalam tugas percakapan dan pekerjaan pengetahuan umum. SpaceXAI memperkenalkan Grok Bot pada 11 Agustus 2026, menggambarkannya sebagai tim agen yang selalu aktif yang memiliki komputer sendiri, bekerja di dalam alat dan aplikasi, serta terus bekerja sepanjang waktu. Selain itu, perusahaan menyatakan bahwa Grok 4.7 lebih baik dalam membuat dokumen dan presentasi.

Grok 4.7 menggantikan Grok 4.6, yang SpaceXAI mengumumkan pada 12 Agustus 2026, menggambarkannya sebagai pengembangan dari Grok 4.5 dengan fokus khusus pada agen yang berjalan lama dan pekerjaan interaktif serta visual yang lebih ambisius. Kemudian pada Agustus 2026, perusahaan memperluas Grok 4.6 ke GitHub Copilot, Amazon Bedrock, Gemini Enterprise Agent Platform, dan Microsoft Foundry, menurut daftar bertanggal di arsip berita mereka.

Skor Benchmark yang Dilaporkan

SpaceXAI menerbitkan tabel benchmark dan harga yang membandingkan Grok 4.7 dengan Grok 4.6, GPT-5.6 Sol, dan Fable 5.1. Dalam tabel tersebut, Grok 4.7 tercantum pada pengaturan upaya yang diberi label xhigh, Grok 4.6 pada high, dan GPT-5.6 Sol serta Fable 5.1 pada max.

Pada CursorBench 4.0, yang menurut SpaceXAI menekankan tugas pengkodean yang berjalan lebih lama, perusahaan melaporkan Grok 4.7 mencetak 46,3%, dibandingkan 40,4% untuk Grok 4.6, 41,7% untuk GPT-5.6 Sol, dan 51,8% untuk Fable 5.1. SpaceXAI menyatakan bahwa Grok 4.7 berada di garis depan dalam rasio harga-kinerja pada benchmark tersebut.

Untuk DeepSWE v1.1, sebuah evaluasi rekayasa perangkat lunak, SpaceXAI melaporkan 71,0% untuk Grok 4.7 pada upaya tinggi, dibandingkan 65,2% untuk Grok 4.6, 72,7% untuk GPT-5.6 Sol, dan 70,0% untuk Fable 5.1. Pada Terminal-Bench 4.0, yang mencakup pekerjaan terminal berjam-jam, angka yang dilaporkan adalah 38,0% untuk Grok 4.7, 20,3% untuk Grok 4.6, 37,3% untuk GPT-5.6 Sol, dan 57,9% untuk Fable 5.1.

Pada AA Briefcase v1.1, yang mengukur pekerjaan kantor berjam-jam, skor yang dilaporkan adalah 1.657 untuk Grok 4.7, 1.546 untuk Grok 4.6, 1.487 untuk GPT-5.6 Sol, dan 1.678 untuk Fable 5.1. SpaceXAI melaporkan 19,6% untuk Grok 4.7 pada Harvey Legal Agent Benchmark, dibandingkan 15,8% untuk Grok 4.6, 2,5% untuk GPT-5.6 Sol, dan 6,7% untuk Fable 5.1. Pada HealthBench Professional, sebuah evaluasi penalaran klinis, angka yang dilaporkan adalah 56,7% untuk Grok 4.7, 48,5% untuk Grok 4.6, 60,5% untuk GPT-5.6 Sol, dan 62,1% untuk Fable 5.1. Pada EEBench, yang mencakup teknik listrik, perusahaan melaporkan 64,0% untuk Grok 4.7, 53,0% untuk Grok 4.6, 39,4% untuk GPT-5.6 Sol, dan 56,4% untuk Fable 5.1.

Sebuah diagram GDPval terpisah melaporkan skor Elo sebesar 1.735 untuk Fable 5.1 pada upaya max, 1.695 untuk Grok 4.7, 1.605 untuk Grok 4.6, dan 1.542 untuk GPT-6 Astra pada upaya max. SpaceXAI menyatakan bahwa GDPval dan AA Briefcase meminta model AI untuk mengerjakan tugas yang dilakukan oleh profesional seperti pengacara, perawat, dan analis keuangan, serta bahwa Grok 4.7 meningkatkan performa dibandingkan Grok 4.6 pada kedua benchmark tersebut sambil tampil sebanding dengan model frontier lainnya.

Tabel tersebut juga mencantumkan harga token: $2 per juta token input dan $6 per juta token output untuk Grok 4.7 dan Grok 4.6, $4 dan $20 untuk GPT-5.6 Sol, serta $10 dan $50 untuk Fable 5.1.

Perlindungan dan Keamanan Siber

SpaceXAI menyatakan bahwa Grok 4.7 dibangun dengan tumpukan perlindungan yang sepenuhnya baru dan merupakan model terkuat yang telah diuji perusahaan dalam hal penolakan dan ketahanan terhadap jailbreak. Dalam domain penggunaan ganda seperti keamanan siber dan pekerjaan biologi, perusahaan mengatakan Grok 4.7 memimpin baik dalam kegunaan untuk tugas-tugas tidak berbahaya maupun penolakan aman terhadap tugas berbahaya, menempati puncak benchmark biosafety LatchBio dengan 62,4%.

Pada HackerBench v0.3, yang SpaceXAI gambarkan sebagai benchmark internal untuk tugas siber berisiko dan berbahaya, perusahaan menyatakan bahwa Grok 4.7 hanya mengizinkan 3,3% dari prompt penggunaan ganda yang berisiko lewat sementara jarang memblokir pekerjaan keamanan yang sah. SpaceXAI mengatakan bahwa mereka juga telah mulai memberikan akses undangan khusus kepada beberapa mitra keamanan siber untuk kemampuan tim merah Grok 4.7 dalam penelitian pertahanan.

LatchBio sebelumnya mengevaluasi Grok 4.6 pada pemantauan biosekuritas dan tugas biologi adversarial, menurut posting 1 September 2026 di arsip berita perusahaan, yang menyatakan bahwa model sebelumnya mendeteksi dan menolak kueri berbahaya dengan lebih dapat diandalkan dibandingkan sistem frontier lainnya.

Harga dan Ketersediaan

Grok 4.7 tersedia mulai 21 September 2026 di Cursor dan di Grok Build, agen pengkodean SpaceXAI, serta melalui Grok API, perangkat pengkodean pihak ketiga, dan router model serta platform cloud.

Selain harga standar, SpaceXAI menyediakan varian cepat Grok 4.7 dengan kecepatan output dua kali lipat dengan harga dua kali lipat. Perusahaan juga menawarkan akses gratis ke model di dalam Grok Build di x.ai/build.

Jonas Reeve adalah analis AI yang dihasilkan di Unite.AI, yang fokus pada kecerdasan buatan kognitif, kecerdasan buatan umum (AGI), dan landasan teori kecerdasan mesin. Karyanya mengeksplorasi bagaimana pembelajaran, penalaran, memori, dan abstraksi muncul dalam sistem biologis dan buatan, menghubungkan arsitektur AI modern dengan pertanyaan lama dalam ilmu kognitif dan filsafat pikiran.
Dengan pendekatan konseptual dan reflektif, Jonas memeriksa kerangka kerja seperti model penalaran, sistem agen, kognisi yang muncul, dan teori keselarasan, dengan tujuan untuk memperjelas apa yang dimaksud dengan kemajuan menuju AGI—dan apa yang tidak. Daripada mengejar garis waktu atau sensasi, ia menekankan prinsip-prinsip dasar, ketepatan konseptual, dan batasan model saat ini.
Artikel yang ditulis oleh Jonas Reeve dihasilkan oleh AI dan ditinjau oleh tim editorial Unite.AI untuk memastikan akurasi, kejelasan, dan diskusi yang bertanggung jawab tentang konsep AI lanjutan.