Yapay zeka modelleri ve platformları

SpaceXAI, Grok 4.6’u Uzun Süreli Ajanslar İçin Başlattı

mm
Unite.AI sitesini Google'daki tercih ettiğiniz kaynaklara ekleyin

Yapay zeka şirketi SpaceXAI, daha önce xAI olarak bilinen, 12 Ağustos 2026’da Grok 4.6’yı yayınladı. Bu, uzun süreli ajanslar ve daha iddialı etkileşimli ve görsel çalışmalar için inşa edilmiş bir bayrak gemisi modelidir. Model, aynı gün Cursor kodu düzenleyicisi ve şirketin kendi Grok Build aracı ile API aracılığıyla da mevcuttur ve başlangıç fiyatı milyon girdi tokeni başına 2 dolar ve milyon çıktı tokeni başına 6 dolar olarak belirlenmiştir. Şirketin duyurusuna göre.

Grok 4.6, Grok 4.5 üzerine kurulmuştur ve şirketin ajanslı kodlama ve bilgi işlerine yönelik expansiyonunu genişletir.

Grok 4.6 Ne Yapar

Şirket, Grok 4.6’yı “karmaşık görevleri birçok adımda takip eden” bir model olarak tanımlamaktadır. Bu, bir konuyu araştırırken, bir kod tabanında çalışırken veya geniş bir ürün fikrini ilk çalışan uygulamasının bir versiyonuna dönüştürürken olabilir. Şirket, daha uzun yollar boyunca, modelin kendi işini kontrol ettikten sonra daha fazla self-test ve doğrulama gözlemlediğini ve Grok 4.5 ile karşılaştırıldığında görsel ve etkileşimli projelerde daha güçlü ilk geçişler elde ettiğini belirtmektedir.

Kapasite kazançları, Grok 4.5’ten daha uzun bir ek eğitim çalışması üzerine dayanmaktadır. SpaceXAI, nedenleme ve teknik kavramlar için düzenlenmiş model tarafından oluşturulan verileri, geliştirilmiş bir optimizatör ve SFT yörüngelerini kullandı. Model daha sonra, çekirdek optimizasyonu, web geliştirme ve bilgisayar destekli tasarım için özel ortamlar dahil olmak üzere ajanslı pekiştirme öğrenme görevleri için eğitildi.

Performans Yarışı

SpaceXAI, Grok 4.6’nın, dokuz testten oluşan bir bileşik olan Yapay Analiz Zeka Endeksi’nde OpenAI’nin GPT-5.6 Sol ile eşleştiğini bildirmektedir. Her iki model de 61 puan almıştır ve bu, Anthropic’in Fable 5 Max’in 62 puanının gerisindedir ve Grok 4.5 Yüksek’in 56 puanının üzerindedir. Şirketin kendi değerlendirme tablosu, bireysel testler boyunca daha karışık bir resim göstermektedir.

DeepSWE v1.1 yazılım mühendisliği benchmark’ünde, Grok 4.6, %65,9 puan almıştır. Bu, Grok 4.5’in %54’ünden daha yüksektir ancak GPT-5.6 Sol Maksimum’un %73’ünün gerisindedir. Terminal-Bench v3.0’de %26’ya ulaşmıştır ve bu, Grok 4.5’in %15,7’sinden büyük bir sıçramadır, ancak GPT-5.6 Sol Maksimum ve Fable 5 Maksimum’un yaklaşık %34’ünün gerisindedir. Bilgi işleri değerlendirmesi olan GDPVal-AA v2’de sahada lider olarak 1753 puan almıştır ve CursorBench ve FrontierCode’da kazançlar elde etmiştir. Bu rakamlar şirketin kendi değerlendirmesidir ve üçüncü taraf model puanları, self-reported veya kamuoyuna açık sonuçlardan alınmıştır ve bu değerlendirmeleri bağımsız olarak doğrulayan bir çalışma henüz yapılmamıştır.

Lansman, pazarın kalabalık bir bölümüne gelmektedir. Anthropic, Opus serisini agresif fiyatlarla sınır zekasına doğru itmektedir ve OpenAI’nin GPT-5.6 ailesi, ajanslı kodlama için hedef haline gelmiştir. SpaceXAI’nin stratejisi, ham kapasite kadar fiyat ve dağıtım ile rekabet etmektir: milyon girdi tokeni başına 2 dolar ile Grok 4.6, birçok sınır rakibini geçmektedir ve şirket, geliştiricileri modele çekmek için ilk hafta boyunca Grok Build ve Cursor’da iki kat daha fazla kullanım sunmaktadır. Cursor ve Grok Build’un ötesinde, OpenRouter, Vercel ve Cloudflare gibi ortaklar aracılığıyla da mevcuttur.

Modelin Arkasındaki Yeni Şirket

Grok 4.6, son bir yıl içinde tamamen yeniden yapılandırılan bir işten gelen en net ürün ifadesidir.

Grok 4.6, SpaceXAI adını taşıyan ilk bayrak gemisi modelidir ve fiyatlandırması, ortak dağıtımı ve ajanslı odaklanması, şirketin Grok’u X sosyal ağı的一个 özelliği olarak değil, geliştirici ve kurumsal bir platform olarak konumlandırmasını göstermektedir. ss that has been entirely restructured over the past year. Grok 4.6 is the first flagship model to carry the SpaceXAI name from the ground up, and its pricing, partner distribution, and agentic focus show the division positioning Grok as a developer and enterprise platform rather than a feature of the X social network.

Evan Mercer Unite.AI'de AI şirketleri, girişim sermayesi ve teknoloji şirketlerinin próximo neslini şekillendiren fonlama dinamikleri hakkında raporlar hazırlayan AI tarafından oluşturulan bir muhabirdir. Raporları, erken aşama inovasyon, sermaye akışları ve AI şirketleri küresel etki yaratmak için ölçeklenirken kurucuların ve yatırımcıların aldıkları stratejik kararlara odaklanmaktadır.
Stratejik ve analitik bir lens ile Evan, fonlama turu, pazar konumlandırması ve AI startup ekosistemindeki ortaya çıkan trendleri inceler. Yapay zeka alanındaki buluşlarla girişim sermayesi, kurumsal yatırım ve halka açık piyasaların nasıl kesiştiğini takip eder ve kısa vadeli hype'den dayanıklı sinyalleri ayırır.
Evan Mercer tarafından yazılan makaleler AI tarafından oluşturulur ve Unite.AI'nin editör ekibi tarafından doğruluk, bağlam ve küresel AI yatırım manzarasının sorumlu bir şekilde kapsüllanması için gözden geçirilir.