Yapay zeka modelleri ve platformları

Grok 4.6 GitHub Copilot’da Sekiz Geliştirme Yüzeyinde Kullanıma Sunuldu

mm
Unite.AI sitesini Google'daki tercih ettiğiniz kaynaklara ekleyin

xAI’nin Grok 4.6’sı, modelin 12 Ağustos 2026’da piyasaya sürülmesinden iki gün sonra, GitHub Copilot’da kullanıma sunuldu, şirket 14 Ağustos 2026’da duyurdu. Model – xAI’nin şu anki kodlama bayrağı, uzun süredir çalışan ajanlar ve çok adımlı işler için tasarlandı – sekiz yüzeyde Copilot’un model seçicisinden seçilebilir: VS Code, Visual Studio, Copilot CLI, Copilot bulut ajanı, Copilot uygulaması, JetBrains IDE’leri, Xcode ve Eclipse.

GitHub’ın değişim günlüğü girişi, aynı gün yayımlandı, dağıtımın Copilot Pro, Pro+, Max, İş ve Kurumsal planlarını kapsadığını onaylıyor. Bu, yeni bir model eklenmesi için alışılmadık derecede geniştir: JetBrains, Xcode ve Eclipse desteği, Grok 4.6’yı, çoğu Copilot modelinin lansmanının yoğunlaştığı VS Code çekirdeğinin dışında geliştiricilerin önüne getirir.

GitHub, iç testlerinde Grok 4.6’nın, özellikle VS Code ve Copilot CLI’de terminal tabanlı kodlama için sürdürülen akıl yürütme ve araç kullanımını gerektiren daha uzun vadeli görevlerde özellikle iyi performans gösterdiğini söyledi. Bu, xAI’nin modeli lansman sırasında nasıl tanıttığıyla uyumlu. “Grok 4.6, Grok 4.5 üzerinde, özellikle uzun süredir çalışan ajanlar ve daha iddialı etkileşimli ve görsel işler üzerinde odaklanarak inşa edildi,” şirket, yayın postasında yazdı.

Grok 4.6 Model Seçicisine Getirileri

Grok 4.6, Copilot’da, self-reported rakamların geçerli olduğu tüm kodlama sınıfının en üstünde yer alan bir dizi satıcı tarafından bildirilen değerlendirme sonuçlarıyla birlikte geliyor. Şirketin yayınladığı değerlendirmede, Grok 4.6 Yüksek, 61 puanla, dokuz benchmarkın bir bileşimi olan Yapay Analiz Zeka Endeksini, OpenAI’nin GPT-5.6 Sol Maksimum ile eşleştirir ve Anthropic’in Fable 5 Maksimum’un 62 puanının bir puan gerisinde kalır. Bilgi-iş değerlendirme olan GDPVal-AA’da, Grok 4.6, 1753 puanla, GPT-5.6 Sol Maksimum’un 1728 puanını ve Fable 5 Maksimum’un 1741 puanını geride bırakır.

Ajantik kodlama benchmarklarında fark daha geniştir. Grok 4.6, CursorBench v3.2’de %69,9 puanla, GPT-5.6 Sol Maksimum’un %67,2’sini geçer ve Fable 5 Maksimum’un %70,5’inden geride kalır. DeepSWE v1.1’de %65,9 puanla, önceki Grok 4.5 Yüksek’in %54’ünü geçer, ancak GPT-5.6 Sol Maksimum’un %73’ünden geride kalır. Terminal-Bench v3.0’da, GitHub’ın vurguladığı terminal işini ölçen, Grok 4.6, %26 puanla, GPT-5.6 Sol Maksimum’un %34,6’sına karşı, Grok 4.5 Yüksek’in %15,7’sini neredeyse ikiye katlar.

Modelin eğitim tarifi, xAI’nin hesabına göre, küratörlü akıl yürütme ve mühendislik verilerini içeren daha uzun bir ek eğitim çalışmasıyla başladı, bunu Grok 4.5 tarafından üretilen denetimli fine-tuning yolları izledi ve ajantik görevler dahil olmak üzere takviye öğrenimiyle devam etti: çekirdek optimizasyonu, web geliştirme ve bilgisayar destekli tasarım. Terminal ve ajantik benchmarklerdeki atılım, görünen sonuçtır, Grok 4.6 her ölçekte lider olmasa da.

Erişim ve Faturalandırma Hakkında Detaylar

İki kısıtlama, modeli kimlerin göreceğini ve maliyetini şekillendirir. İlk olarak, dağıtım dần dần gerçekleşir: GitHub, geliştiricilerin modeli seçicide görmüyorlarsa, erişilebilirlik genişledikçe geri dönmesini önerir. İkincisi, Copilot İş ve Kurumsal planlarında, Grok 4.6 ilkesi varsayılan olarak kapalıdır ve bir yönetici, koltukların modeli seçebilmesi için Copilot ayarlarında etkinleştirmelidir.

Faturalandırma açısından, Grok 4.6, kullanım tabanlı faturalandırma kapsamında provider listesi fiyatlandırmasıyla ücretlendirilir, bu da sabit istek kotasından düşülmesi yerine gerçekleşir. Grok 4.6, provider listesi fiyatlandırmasıyla faturalandırılır; xAI, API fiyatlandırmasını, girişte 2 milyon token başına 2 dolar ve çıkışta 6 milyon token başına 6 dolar olarak listeler, bu, GitHub’ın Grok 4.5 için fiyatlandırma tablosunda uyguladığı aynı temel orandır ve Grok 4.6’yı, seçicideki diğer bayrak gemisi seçeneklerine kıyasla fiyat olarak oldukça düşük gösterir: GPT-5.6 Sol, girişte 5 dolar ve çıkışta 30 dolar olarak listelenir, Claude Opus-class modelleri ise girişte 5 dolar ve çıkışta 25 dolar olarak listelenir.

Copilot dışında, Grok 4.6, xAI’nin API’si, Cursor, Grok Build ve OpenRouter, Vercel ve Cloudflare gibi ortaklar aracılığıyla erişilebilir durumda. Unite.AI’nin lansman raporunda yer aldığı gibi, xAI, modelin ilk haftasında Grok Build ve Cursor için dahil edilen kullanımın iki katına çıkardı, bu süre 19 Ağustos 2026’da sona erecek.

Copilot entegrasyonu, Grok 4.6’nın ilk 48 saatinin dağıtım modelini genişletiyor: xAI’nin kendi araçlarında ve Cursor’da lansman, ardından koltuk sayısına göre en büyük üçüncü taraf kodlama asistanına girme. İş ve Kurumsal politika kapısı şimdi yöneticilerin elinde olduğundan, modelin kurumsal benimsenme hızı, herhangi bir liderlik tablosunda görünmeden önce Copilot ayarlarında görünmeye başlayacak.

Jonas Reeve bilişsel AI, yapay genel zeka (AGI) ve makine zekasının teorik temelleri üzerine odaklanan Unite.AI'de AI tarafından oluşturulan bir analisttir. Çalışmaları, öğrenme, akıl yürütme, bellek ve soyutlama gibi kavramların hem biyolojik hem de yapay sistemlerde nasıl ortaya çıktığını keşfederek, modern AI mimarileri ile bilişsel bilim ve zihin felsefesindeki uzun süredir devam eden sorular arasında bağlantılar kurar.
Kavramsal ve düşünceli bir yaklaşım benimseyen Jonas, akıl yürütme modelleri, ajan sistemleri, ortaya çıkan biliş ve hizalama teorisi gibi çerçeveleri inceleyerek, AGI'ye doğru ilerlemenin ne anlama geldiğini - ve ne anlamadığını - açıklamayı amaçlar. Zaman çizelgesi veya hırs peşinde koşmak yerine, ilk ilkeleri, kavramsal titizliği ve mevcut modellerin sınırlarını vurgular.
Jonas Reeve tarafından yazılan makaleler AI tarafından oluşturulur ve Unite.AI'nin editör ekibi tarafından advanced AI kavramlarının doğruluğu, açıklığı ve sorumlu tartışması için gözden geçirilir.