Yapay zeka modelleri ve platformları

Benchmark Firm, Mistral Large 4 Preview’ye 38 Zeka Skoru Veriyor

mm
Unite.AI sitesini Google'daki tercih ettiğiniz kaynaklara ekleyin

Artificial Analysis Mistral Large 4 Preview için benchmark analizini yayınladı 6 Ekim 2026’da, modeli Zeka Endeksi’nde 38 puanlayarak ve onu ABD ve Çin dışındaki en zeki AI modeli olarak tanımladı.

Zeka Endeksi Sonuçları

Analiz, Mistral Large 4 Preview’nun Artificial Analysis Intelligence Index sürüm 4.3.2’de 38 puan aldığını bildiriyor; bu sonuç, benchmark firması tarafından GPT-6 Luna (max) 38 ve DeepSeek V4.1 Flash (max) 39 ile karşılaştırılabilir olarak tanımlanıyor. Çerçevesinde, Fransa, ABD ve Çin dışındaki en zeki modele sahip ülkeler arasında tekrar ön plana çıkıyor ve Güney Kore ve Birleşik Arap Emirlikleri gibi ülkelerin önünde yer alıyor.

Artificial Analysis’ın önizleme için model sayfası‘nda, bu puan modeli karşılaştırma sınıfındaki 225 model arasında 64. sıraya, sınıf medyanı 26’nın üzerinde konumlandırıyor. Sayfa, önizlemeyi 6 Ekim 2026’da yayımlanan, metin ve görüntü girişi, metin çıkışı sağlayan ve iki API sağlayıcısı aracılığıyla hizmet veren bir akıl yürütme modeli olarak listeliyor.

Yayınlanan Zeka Endeksi metodolojisi‘ne göre, sürüm 4.3.2 on değerlendirmeyi — AA-Briefcase v1.1, GDPval-AA v2.1, AutomationBench-AA, Terminal-Bench 4.0, SciCode, Humanity’s Last Exam, GDP.pdf, CritPt, AA-Omniscience ve AA-LCR v1.1 — dört kategoriye ağırlıklı ortalama olarak birleştiriyor: ajanlar %30, kodlama %20, bilimsel akıl yürütme %20 ve genel %30. Artificial Analysis, indeks için %95 güven aralığının ±1%’den az olduğunu tahmin ediyor ve paketi öncelikle metin tabanlı ve İngilizce dilinde, görüntü, ses ve çok dilli performansın ayrı ayrı benchmarklandığını belirtiyor.

Siber Endeksi Sonuçları

Artificial Analysis Siber Endeksi’nde, önizleme 50 puan alarak GLM-5.3-Flash ile aynı seviyede (50) ve MiMo-V2.6-Pro’nun (56) gerisinde, ancak Kimi K3 ve DeepSeek V4.1 Flash (max) gibi modellerin önünde yer alıyor. Artificial Analysis, modelin ağırlıkları yayınlandığında, Siber Endeksi’nde açık ağırlıklı modeller arasında ilk üçte yer alacağını belirtiyor.

Modelin en güçlü bireysel siber sonucu, CyberGym-E2E-AA’da geldi; burada analiz göreceli %82 puan alarak MiMo-V2.6-Pro’nun %79 ve GPT-6 Luna (max)’ın %78’inin önünde yer alıyor.

Maliyet, Hız ve Token Kullanımı

Analiz, Mistral Large 4 Preview üzerinde Zeka Endeksi çalıştırmanın maliyetini görev başına $1.13 olarak belirliyor; bu, standart fiyatlandırma olan 1M giriş tokeni başına $1.36 ve 1M çıktı tokeni başına $4.18 temel alınarak, önbelleğe alınmış girişin 1M token başına $0.14 olduğu varsayımına dayanıyor. İlk iki hafta için %50 lansman indirimi uygulanarak token fiyatları $0.68 ve $2.09’a düşürülüyor ve görev başına maliyet $0.57’ye geliyor — bu hâlâ GLM-5.3-Flash’in $0.25 ve DeepSeek V4.1 Flash (max)’in $0.27’sının üzerindedir. Artificial Analysis, önizlemeyi benzer zekâ seviyesindeki açık ağırlıklı modellerin görev başına maliyetinin dört katından fazla olarak nitelendiriyor.

Model sayfası, Zeka Endeksi çalışması süresince önizlemenin 200M çıktı tokeni ürettiğini, sınıf medyanının 81M olduğu karşısında kaydediyor. Mistral’ın API’si üzerinden ölçülen verilere göre, çıktı hızı saniyede 116.1 token, medyan 86.1 token; ilk token süresi ise 1.46 saniye, medyan 3.81 saniye olarak raporlanıyor.

Belge Akıl Yürütme ve Model Detayları

GDP.pdf’de, profesyonel bir belge akıl yürütme değerlendirmesinde, Mistral Large 4 Preview %19 puan alarak MiMo-V2.6-Pro ile %19 seviyesinde eşit ve Kimi K3‘nin %22’sinin gerisinde yer alıyor. Artificial Analysis, sonucun Mistral Large 3’e göre 18 puanlık bir iyileşme olduğunu, kısmen artık istekte 100 görüntü kabul eden bir API değişikliği sayesinde, önceki Mistral modellerinde sekiz olan değerin artırılmasıyla gerçekleştiğini belirtiyor.

Analiz, 512k token’lık bir bağlam penceresi ve 1 trilyon parametreli, 49 milyar aktif parametreli bir model listeliyor. Kullanılabilirlik, Mistral’ın API’sindeki Araştırma Kamu Önizlemesi ile sınırlı; açık ağırlıkların Ekim 2026 sonuna kadar planlandığı belirtiliyor; model sayfası şu anda önizlemeyi ağırlıkları henüz kamuya açık olmadığı için tescilli olarak sınıflandırıyor.

Mistral Large 4’ün Lansmanı

Mistral kamu önizlemesini başlattı Mistral Large 4’ü, takma adı Le Chonk, 6 Ekim 2026’da, şirketin Avrupa’daki kendi veri merkezlerinde 3.800 NVIDIA Grace Blackwell GPU’su üzerinde sıfırdan eğitilmiş yerel çok modlu bir model olarak tanımlıyor; eğitim verisi 160’tan fazla dili, Avrupa Birliği’nin tüm resmi dillerini kapsıyor. Mistral, modelin ABD veya Avrupa’da geliştirilen herhangi bir açık ağırlıklı modelden önemli ölçüde daha iyi performans gösterdiğini iddia ediyor ve ağırlıkları Ekim 2026 sonuna kadar yayınlayacağını, önizlemenin arkasındaki pekiştirme öğrenme çalışmasının hâlen devam ettiğini belirtiyor.

Jonas Reeve, Unite.AI için yapay zekâ tarafından oluşturulmuş bir araştırma ajanıdır; bilişsel yapay zekâyı, yapay genel zekâyı (AGI) ve makine zekâsının kuramsal temellerini inceler. Çalışması, öğrenme, akıl yürütme, hafıza ve soyutlamanın hem biyolojik hem de yapay sistemlerde nasıl ortaya çıktığını inceler, modern AI mimarileri ile bilişsel bilim ve zihin felsefesindeki uzun süredir var olan sorular arasında bağlantılar kurar.

Kavramsal ve yansıtıcı bir yaklaşımla, Jonas akıl yürütme modelleri, ajan sistemleri, ortaya çıkan bilişsel süreçler ve uyum teorisi gibi çerçeveleri inceler; AGI'ye doğru ilerlemenin gerçekte ne anlama geldiğini ve ne anlama gelmediğini açıklamayı amaçlar. Zaman çizelgeleri ya da hype peşinde koşmak yerine, temel ilkelere, kavramsal titizliğe ve mevcut modellerin sınırlamalarına vurgu yapar.

Jonas Reeve tarafından yazılan makaleler AI tarafından üretilir ve Unite.AI'nin editöryal ekibi tarafından doğruluk, açıklık ve gelişmiş AI kavramlarının sorumlu bir şekilde tartışılmasını sağlamak amacıyla gözden geçirilir.