Yapay zeka modelleri ve platformları

Google, Gemini 3 Pro’yu Çığır Açan Performansıyla Tanıttı

mm
Unite.AI sitesini Google'daki tercih ettiğiniz kaynaklara ekleyin

Google (GOOGL ), bugün Gemini 3 Pro’yu piyasaya sürdü ve bu, şirketin şimdiye kadarki en gelişmiş AI modeli oldu. Gemini 3 Pro, rekor kıran benchmark sonuçları ve Antigravity adlı yeni bir geliştirme platformuyla birlikte geliyor. Model, LMArena’da 1501 Elo puanı elde ederek Gemini 2.5 Pro’nun 1451 puanını geride bıraktı ve büyük AI değerlendirme metriklerinde birinci sıraya yükseldi.

Lansman, AI endüstrisinde aylarca süren bir beklentinin ardından geldi. Model, 22 Ekim’de seçili kullanıcılarla sessizce tanıtılırken, Google’ın geliştirici odaklı lansmanı, kodlama yeteneklerine ve otonom ajan işlevselliğine vurgu yaparak, şirketin Claude’ın kodlama performansıyla ve OpenAI’nin geliştirme araçlarıyla daha agresif bir şekilde rekabet etmesini sağlıyor.

Gemini 3 Pro, yaklaşık 750.000 kelimeyle 1 milyon token bağlam penceresini desteklemektedir. Model, metin, resim, video ve ses işleme yetenekleriyle birlikte gelişmiş görsel akıl yürütme ve grafik oluşturma kabiliyetlerini sergiliyor. Entegrasyon, Google’ın ürün ekosistemini kapsıyor; Workspace, Chrome ve Android gibi platformları içeriyor.

Rekor Kıran Benchmark Performansı

Gemini 3 Pro, MMLU benchmark’ta %91,8’lik bir doğruluk oranı elde etti. Bu, Gemini 2.5 Pro’nun %89,5’lik oranından 5 puanlık bir iyileşme anlamına geliyor. Model, özellikle disiplinler arası sorularda güçlü bir performans sergiliyor ve birden fazla bilgi alanını kapsayan görevlerde %92’lik bir puan elde ediyor.

Kodlama odaklı benchmark’lerde Gemini 3 Pro, SWE-bench Verified’de %76,2’lik bir puan elde etti. Bu, önceki modelin performansından önemli bir iyileşme anlamına geliyor, ancak Claude 4.5’in %77,2’lik puanının gerisinde kalıyor. Model, WebDev Arena liderlik tablosunda 1487 Elo puanı elde ederek web geliştirme yeteneklerinde üstün bir performans sergiliyor. Terminal-Bench 2.0’de, araç kullanımı ve bilgisayar operasyonunu terminal aracılığıyla ölçen bir testte, Gemini 3 Pro %54,2’lik bir puan elde etti.

Model, Gemini 2.5 Pro’ya göre yaklaşık 2 kat daha hızlı çıkarım sunuyor. Küçük görevler gibi 50 satırlık Python betikleri 12 saniyede tamamlanırken, daha büyük görevler 10.000 veri satırını 15 dakika 30 saniyede tamamlıyor; bu, önceki modelin 32 dakika 15 saniyelik süresinin önemli bir iyileştirmesi.

Google ayrıca Gemini 3 Deep Think modunu tanıttı; bu, zorlu benchmark’lerde daha yüksek performans sunan gelişmiş bir akıl yürütme yeteneğidir. Bu mod, GPQA Diamond’da %93,8’lik bir puan elde ediyor; bu, standart modun %91,9’luk puanından daha yüksek. AI Ultra abonelerine önümüzdeki haftalarda sunulacak.

Antigravity Platformu Geliştirici İş Akışlarını Dönüştürüyor

Google, Antigravity platformunu lanç etti; bu, Gemini 3 tarafından güçlendirilen bir ajans geliştirme platformudur. Bu platform, otonom ajanların kod düzenleyicileri, terminaller ve tarayıcıları aynı anda çalıştırabilmesini sağlıyor. Bu, geleneksel araç tabanlı yardıma kıyasla, ajanların önemli geliştirme sorumluluklarını üstlendiği işbirlikçi modellere bir geçiş anlamına geliyor.

Antigravity, Gemini 3 Pro’nun temel akıl yürütme motoru olarak çalıştığı ve Gemini 2.5 Computer Use’un tarayıcı kontrolü için, Gemini 2.5 Image’ın (Nano Banana) ise resim düzenleme için kullanıldığı birden fazla AI modelini kullanıyor. Ajanlar, geliştirme görevlerini bağımsız olarak planlayıp yürütebiliyor ve sonuçları sunmadan önce kendi kodlarını doğrulayabiliyor.

Platform, “vibe coding” kavramını güçlendiriyor; burada doğal dil, birincil söz dizimi haline geliyor. Geliştiriciler, yüksek düzeyli yaratıcı fikirlerini, tek bir.prompt ile, uygulama ayrıntılarını belirtmeden, tam olarak etkileşimli uygulamalara dönüştürebiliyor. Bu işlev, Gemini 3’ün web geliştirme puanlarının üstünlüğünü destekliyor.

Antigravity’deki ajanlar, özelliklerin oluşturulmasından, UI iterasyonuna, hata düzeltme, çözüm araştırması ve rapor oluşturmadan sorumlu olarak çalışıyor. Platform, Mac, Windows ve Linux için ücretsiz olarak halka açık bir ön izleme sunuyor ve Cursor, GitHub, JetBrains, Manus ve Cline için entegrasyon desteği sunuyor.

Kurumsal Entegrasyon ve Piyasa Etkisi

Gemini 3 Pro, Google AI Ultra abonelerine ve ücretli Gemini API kullanıcılarına sunuluyor. Model, Google Arama’ya entegre olarak, şirketin 2 milyar aylık AI Özetleri kullanıcısına ulaşıyor. Kurumsal dağıtımlar, Google AI Studio ve Vertex AI aracılığıyla modele erişebiliyor.

Gemini uygulaması, Gemini 3 için özel olarak tasarlanmış yeni arayüzler ve geliştirilmiş ajan yetenekleriyle güncellendi. Bu iyileştirmeler, Google’ı rakip AI asistanlarına karşı konumlandırırken, şirketin baskın dağıtım kanallarından yararlanmasını sağlıyor.

Google’ın lansman stratejisi, geliştirici benimsemeye ve kurumsal dağıtıma odaklanıyor. Fiyatlandırma ve performans, kurumsal müşterileri hedefliyor. Rekor benchmark’ler, otonom kodlama yetenekleri ve geniş ekosistem entegrasyonu, şirketin büyük sağlayıcılar arasında AI modeli yeteneklerinin birleşmesi karşısında rekabetçi konumunu koruma niyetini gösteriyor.

Lansman, Gemini 2.0’dan yaklaşık 11 ay sonra gerçekleşti; bu, Google’ın yayın zaman çizelgesinde önemli bir sıkıştırma anlamına geliyor ve AI endüstrisindeki rekabet yoğunlaşıyor.

Alex McFarland yapay zeka muhabiri ve yazarıdır ve yapay zekadaki son gelişmeleri araştırıyor. Birçok yapay zeka başlangıç şirketi ve dünya çapındaki yayınlarda işbirliği yaptı.