Yapay zeka modelleri ve platformları
GLM-5.3, Artificial Analysis Zeka Endeksi’nde 60 Puan Aldı, Kimi K3 ile Eşleşti

Z.ai’nın GLM-5.3 modeli Artificial Analysis tarafından değerlendirildi ve 18 Ağustos 2026 tarihinde bağımsız değerlendirme kuruluşu, Çin laboratuvarının en yeni akıl yürütme modelini Moonshot AI’nın Kimi K3 modeliyle aynı seviyeye, Anthropic’in Claude Opus 5 modelinden ise üç puan geride, 63 puanla lider konumda yer alarak 60 puan verdi.
Bu puan, Z.ai’nın kodlama işleri için önerdiği maksimum akıl yürütme çabasıyla çalışan GLM-5.3’ü kapsar. 60 puan, karşılaştırma sınıfındaki 181 modelin 35 ortalama puanının çok üzerindedir ve sınıf içinde sekizinci sıradadır.
Bu sonuç, Z.ai’nın 14 Ağustos 2026’da yayımladığı modelin ilk bağımsız okumasıdır; model alışılmadık bir yapıya sahiptir: GLM-5.3, GLM-5.2 ile aynı temel modeli kullanır ve tüm yetenek artışları yeni bir ön‑eğitim yerine son‑eğitimle elde edilmiştir.
GLM-5.3 Nasıl Buraya Geldi
Z.ai’nın yayın sonrası açıklaması, uzun vadeli görev ortamlarında bir ay süren pekiştirmeli öğrenme ölçeklendirmesini anlatır: daha fazla ortam, daha çeşitli görevler, daha fazla hesaplama, hepsi laboratuvarın GLM-5.2 için inşa ettiği eğitim yığını üzerinde. Şirket, bu yaklaşımın Terminal-Bench 3.0 puanını 4.6’dan 28.3’e, DeepSWE v1.1 puanını 46.2’den 66.9’a yükselttiğini rapor etti; ayrıca kendi gönderisi, kodlama, siber güvenlik ve ajan bazlı benchmark’larda Kimi K3, Claude Opus 4.8, Claude Fable 5 ve GPT-5.6 Sol karşısında elde edilen sonuçları belgeledi. Unite.AI, modelin lansmanını ve ortaya çıkan siber güvenlik sonuçlarını model geçen hafta gönderildiğinde ayrıntılı olarak ele aldı.
Artificial Analysis sayısı, satıcıların raporladığı tablolardan farklı bir ağırlığa sahiptir; çünkü değerlendirici kendi süitesini çalıştırır. Zeka Endeksi v4.1.1, ajan bazlı gerçek dünya iş görevleri, ajan araç kullanımı, terminal kodlama, bilimsel akıl yürütme ve bilgi, lisansüstü bilim soruları, fizik akıl yürütmesi, bilgi güvenilirliği ve halüsinasyon, uzun bağlam akıl yürütmesi gibi dokuz değerlendirmeyi birleştirir. GLM-5.3’ün 60 puanı, bu bataryadaki çalışmasının birleşik sonucudur ve Z.ai API’sinde toplam 1.238,50 $ değerlendirme maliyetiyle elde edilmiştir.
GLM-5.3 Lider Tablosunda Nerede Yer Alıyor
Kimi K3 ile eşitlik, başlık karşılaştırmasıdır. Kimi K3, 16 Temmuz 2026’da yayımlanmış ve endekste aynı 60 puanı alarak Artificial Analysis sıralamasında açık‑ağırlıklı modeller arasında en üst puanı koruyan model konumunu sürdürür; bu konumu GLM-5.3 puan olarak paylaşır ancak lisans açısından farklıdır. Moonshot, Kimi K3 ağırlıklarını gelir‑tabanlı bir lisansla temmuz 2026’da açtı; GLM-5.3 şu an için tescilli olarak listeleniyor ve Artificial Analysis model için 753 milyar parametre kaydetti.
Claude Opus 5, 24 Temmuz 2026’da yayımlanmış ve endekste hâlâ 63 puanla lider konumda. GLM-5.3 ile lider arasındaki üç puanlık fark, hızlı bir son‑eğitim döngüsünün kapatamadığı bir mesafeyi gösterir; bu fark, baharın ardından kendisini yeniden konumlandıran bir sınırla karşılaştırıldığında ortaya çıkar.
Fiyat, iki 60 puanlı modelin keskin şekilde ayrıldığı noktadır. GLM-5.3, Z.ai API’sinde giriş token başına 1,40 $ ve çıkış token başına 4,40 $ ücret alırken, Kimi K3 Moonshot’ta sırasıyla 3,00 $ ve 15,00 $ tutar. Zeka Endeksi görev başına maliyet, GLM-5.3 için 0,68 $, Kimi K3 için 0,84 $, Claude Opus 5 için ise 2,34 $’dır. GLM-5.3, üç model arasında puanını en düşük görev maliyetiyle elde eder; ancak grup içinde en çok token üreten model olup, değerlendirme sürecinde sınıfının 72 milyon ortalama tokenine karşı 170 milyon çıkış tokeni üretmiştir.
Gelecek Neler Sunuyor
GLM-5.3, Z.ai API’si üzerinden erişilebilir ve tüm GLM Coding Plan abonelerine sunulmuştur. Model, düşünme (thinking) özelliğinin etkinleştirilmesini gerektirir ve üç çaba seviyesi sunar; Z.ai, düşünme devre dışı bırakılarak kullanılan uygulamaların, taşınana kadar başarısız olacağını uyarır.
Ağırlıklar hâlâ eksik parçadır. Z.ai, güvenlik değerlendirmesi ve sağlamlaştırma tamamlandıktan iki hafta sonra, 14 Ağustos 2026 lansmanının ardından ağırlıkları yayınlamayı taahhüt etmiştir; bu, GLM-5.3’ü Kimi K3 ile birlikte açık‑ağırlıklı bir seçenek olarak endeksin 60 puan seviyesine getirir ve token başına fiyatın yaklaşık yarısına düşürür.












