Yapay zeka modelleri ve platformları
SpaceXAI, Grok 4.6’u Uzun Süreli Ajanslar İçin Başlattı

Yapay zeka şirketi SpaceXAI, daha önce xAI olarak bilinen, 12 Ağustos 2026’da Grok 4.6’yı yayınladı. Bu, uzun süreli ajanslar ve daha iddialı etkileşimli ve görsel çalışmalar için inşa edilmiş bir bayrak gemisi modelidir. Model, aynı gün Cursor kodu düzenleyicisi ve şirketin kendi Grok Build aracı ile API aracılığıyla da mevcuttur ve başlangıç fiyatı milyon girdi tokeni başına 2 dolar ve milyon çıktı tokeni başına 6 dolar olarak belirlenmiştir. Şirketin duyurusuna göre.
Grok 4.6, Grok 4.5 üzerine kurulmuştur ve şirketin ajanslı kodlama ve bilgi işlerine yönelik expansiyonunu genişletir.
Grok 4.6 Ne Yapar
Şirket, Grok 4.6’yı “karmaşık görevleri birçok adımda takip eden” bir model olarak tanımlamaktadır. Bu, bir konuyu araştırırken, bir kod tabanında çalışırken veya geniş bir ürün fikrini ilk çalışan uygulamasının bir versiyonuna dönüştürürken olabilir. Şirket, daha uzun yollar boyunca, modelin kendi işini kontrol ettikten sonra daha fazla self-test ve doğrulama gözlemlediğini ve Grok 4.5 ile karşılaştırıldığında görsel ve etkileşimli projelerde daha güçlü ilk geçişler elde ettiğini belirtmektedir.
Kapasite kazançları, Grok 4.5’ten daha uzun bir ek eğitim çalışması üzerine dayanmaktadır. SpaceXAI, nedenleme ve teknik kavramlar için düzenlenmiş model tarafından oluşturulan verileri, geliştirilmiş bir optimizatör ve SFT yörüngelerini kullandı. Model daha sonra, çekirdek optimizasyonu, web geliştirme ve bilgisayar destekli tasarım için özel ortamlar dahil olmak üzere ajanslı pekiştirme öğrenme görevleri için eğitildi.
Performans Yarışı
SpaceXAI, Grok 4.6’nın, dokuz testten oluşan bir bileşik olan Yapay Analiz Zeka Endeksi’nde OpenAI’nin GPT-5.6 Sol ile eşleştiğini bildirmektedir. Her iki model de 61 puan almıştır ve bu, Anthropic’in Fable 5 Max’in 62 puanının gerisindedir ve Grok 4.5 Yüksek’in 56 puanının üzerindedir. Şirketin kendi değerlendirme tablosu, bireysel testler boyunca daha karışık bir resim göstermektedir.
DeepSWE v1.1 yazılım mühendisliği benchmark’ünde, Grok 4.6, %65,9 puan almıştır. Bu, Grok 4.5’in %54’ünden daha yüksektir ancak GPT-5.6 Sol Maksimum’un %73’ünün gerisindedir. Terminal-Bench v3.0’de %26’ya ulaşmıştır ve bu, Grok 4.5’in %15,7’sinden büyük bir sıçramadır, ancak GPT-5.6 Sol Maksimum ve Fable 5 Maksimum’un yaklaşık %34’ünün gerisindedir. Bilgi işleri değerlendirmesi olan GDPVal-AA v2’de sahada lider olarak 1753 puan almıştır ve CursorBench ve FrontierCode’da kazançlar elde etmiştir. Bu rakamlar şirketin kendi değerlendirmesidir ve üçüncü taraf model puanları, self-reported veya kamuoyuna açık sonuçlardan alınmıştır ve bu değerlendirmeleri bağımsız olarak doğrulayan bir çalışma henüz yapılmamıştır.
Lansman, pazarın kalabalık bir bölümüne gelmektedir. Anthropic, Opus serisini agresif fiyatlarla sınır zekasına doğru itmektedir ve OpenAI’nin GPT-5.6 ailesi, ajanslı kodlama için hedef haline gelmiştir. SpaceXAI’nin stratejisi, ham kapasite kadar fiyat ve dağıtım ile rekabet etmektir: milyon girdi tokeni başına 2 dolar ile Grok 4.6, birçok sınır rakibini geçmektedir ve şirket, geliştiricileri modele çekmek için ilk hafta boyunca Grok Build ve Cursor’da iki kat daha fazla kullanım sunmaktadır. Cursor ve Grok Build’un ötesinde, OpenRouter, Vercel ve Cloudflare gibi ortaklar aracılığıyla da mevcuttur.
Modelin Arkasındaki Yeni Şirket
Grok 4.6, son bir yıl içinde tamamen yeniden yapılandırılan bir işten gelen en net ürün ifadesidir.
Grok 4.6, SpaceXAI adını taşıyan ilk bayrak gemisi modelidir ve fiyatlandırması, ortak dağıtımı ve ajanslı odaklanması, şirketin Grok’u X sosyal ağı的一个 özelliği olarak değil, geliştirici ve kurumsal bir platform olarak konumlandırmasını göstermektedir. ss that has been entirely restructured over the past year. Grok 4.6 is the first flagship model to carry the SpaceXAI name from the ground up, and its pricing, partner distribution, and agentic focus show the division positioning Grok as a developer and enterprise platform rather than a feature of the X social network.












