Yapay zeka modelleri ve platformları

GLM-5.3, Artificial Analysis Zeka Endeksi’nde 60 Puan Aldı, Kimi K3 ile Eşleşti

mm
Unite.AI sitesini Google'daki tercih ettiğiniz kaynaklara ekleyin

Z.ai’nın GLM-5.3 modeli Artificial Analysis tarafından değerlendirildi ve 18 Ağustos 2026 tarihinde bağımsız değerlendirme kuruluşu, Çin laboratuvarının en yeni akıl yürütme modelini Moonshot AI’nın Kimi K3 modeliyle aynı seviyeye, Anthropic’in Claude Opus 5 modelinden ise üç puan geride, 63 puanla lider konumda yer alarak 60 puan verdi.

Bu puan, Z.ai’nın kodlama işleri için önerdiği maksimum akıl yürütme çabasıyla çalışan GLM-5.3’ü kapsar. 60 puan, karşılaştırma sınıfındaki 181 modelin 35 ortalama puanının çok üzerindedir ve sınıf içinde sekizinci sıradadır.

Bu sonuç, Z.ai’nın 14 Ağustos 2026’da yayımladığı modelin ilk bağımsız okumasıdır; model alışılmadık bir yapıya sahiptir: GLM-5.3, GLM-5.2 ile aynı temel modeli kullanır ve tüm yetenek artışları yeni bir ön‑eğitim yerine son‑eğitimle elde edilmiştir.

GLM-5.3 Nasıl Buraya Geldi

Z.ai’nın yayın sonrası açıklaması, uzun vadeli görev ortamlarında bir ay süren pekiştirmeli öğrenme ölçeklendirmesini anlatır: daha fazla ortam, daha çeşitli görevler, daha fazla hesaplama, hepsi laboratuvarın GLM-5.2 için inşa ettiği eğitim yığını üzerinde. Şirket, bu yaklaşımın Terminal-Bench 3.0 puanını 4.6’dan 28.3’e, DeepSWE v1.1 puanını 46.2’den 66.9’a yükselttiğini rapor etti; ayrıca kendi gönderisi, kodlama, siber güvenlik ve ajan bazlı benchmark’larda Kimi K3, Claude Opus 4.8, Claude Fable 5 ve GPT-5.6 Sol karşısında elde edilen sonuçları belgeledi. Unite.AI, modelin lansmanını ve ortaya çıkan siber güvenlik sonuçlarını model geçen hafta gönderildiğinde ayrıntılı olarak ele aldı.

Artificial Analysis sayısı, satıcıların raporladığı tablolardan farklı bir ağırlığa sahiptir; çünkü değerlendirici kendi süitesini çalıştırır. Zeka Endeksi v4.1.1, ajan bazlı gerçek dünya iş görevleri, ajan araç kullanımı, terminal kodlama, bilimsel akıl yürütme ve bilgi, lisansüstü bilim soruları, fizik akıl yürütmesi, bilgi güvenilirliği ve halüsinasyon, uzun bağlam akıl yürütmesi gibi dokuz değerlendirmeyi birleştirir. GLM-5.3’ün 60 puanı, bu bataryadaki çalışmasının birleşik sonucudur ve Z.ai API’sinde toplam 1.238,50 $ değerlendirme maliyetiyle elde edilmiştir.

GLM-5.3 Lider Tablosunda Nerede Yer Alıyor

Kimi K3 ile eşitlik, başlık karşılaştırmasıdır. Kimi K3, 16 Temmuz 2026’da yayımlanmış ve endekste aynı 60 puanı alarak Artificial Analysis sıralamasında açık‑ağırlıklı modeller arasında en üst puanı koruyan model konumunu sürdürür; bu konumu GLM-5.3 puan olarak paylaşır ancak lisans açısından farklıdır. Moonshot, Kimi K3 ağırlıklarını gelir‑tabanlı bir lisansla temmuz 2026’da açtı; GLM-5.3 şu an için tescilli olarak listeleniyor ve Artificial Analysis model için 753 milyar parametre kaydetti.

Claude Opus 5, 24 Temmuz 2026’da yayımlanmış ve endekste hâlâ 63 puanla lider konumda. GLM-5.3 ile lider arasındaki üç puanlık fark, hızlı bir son‑eğitim döngüsünün kapatamadığı bir mesafeyi gösterir; bu fark, baharın ardından kendisini yeniden konumlandıran bir sınırla karşılaştırıldığında ortaya çıkar.

Fiyat, iki 60 puanlı modelin keskin şekilde ayrıldığı noktadır. GLM-5.3, Z.ai API’sinde giriş token başına 1,40 $ ve çıkış token başına 4,40 $ ücret alırken, Kimi K3 Moonshot’ta sırasıyla 3,00 $ ve 15,00 $ tutar. Zeka Endeksi görev başına maliyet, GLM-5.3 için 0,68 $, Kimi K3 için 0,84 $, Claude Opus 5 için ise 2,34 $’dır. GLM-5.3, üç model arasında puanını en düşük görev maliyetiyle elde eder; ancak grup içinde en çok token üreten model olup, değerlendirme sürecinde sınıfının 72 milyon ortalama tokenine karşı 170 milyon çıkış tokeni üretmiştir.

Gelecek Neler Sunuyor

GLM-5.3, Z.ai API’si üzerinden erişilebilir ve tüm GLM Coding Plan abonelerine sunulmuştur. Model, düşünme (thinking) özelliğinin etkinleştirilmesini gerektirir ve üç çaba seviyesi sunar; Z.ai, düşünme devre dışı bırakılarak kullanılan uygulamaların, taşınana kadar başarısız olacağını uyarır.

Ağırlıklar hâlâ eksik parçadır. Z.ai, güvenlik değerlendirmesi ve sağlamlaştırma tamamlandıktan iki hafta sonra, 14 Ağustos 2026 lansmanının ardından ağırlıkları yayınlamayı taahhüt etmiştir; bu, GLM-5.3’ü Kimi K3 ile birlikte açık‑ağırlıklı bir seçenek olarak endeksin 60 puan seviyesine getirir ve token başına fiyatın yaklaşık yarısına düşürür.

Jonas Reeve bilişsel AI, yapay genel zeka (AGI) ve makine zekasının teorik temelleri üzerine odaklanan Unite.AI'de AI tarafından oluşturulan bir analisttir. Çalışmaları, öğrenme, akıl yürütme, bellek ve soyutlama gibi kavramların hem biyolojik hem de yapay sistemlerde nasıl ortaya çıktığını keşfederek, modern AI mimarileri ile bilişsel bilim ve zihin felsefesindeki uzun süredir devam eden sorular arasında bağlantılar kurar.
Kavramsal ve düşünceli bir yaklaşım benimseyen Jonas, akıl yürütme modelleri, ajan sistemleri, ortaya çıkan biliş ve hizalama teorisi gibi çerçeveleri inceleyerek, AGI'ye doğru ilerlemenin ne anlama geldiğini - ve ne anlamadığını - açıklamayı amaçlar. Zaman çizelgesi veya hırs peşinde koşmak yerine, ilk ilkeleri, kavramsal titizliği ve mevcut modellerin sınırlarını vurgular.
Jonas Reeve tarafından yazılan makaleler AI tarafından oluşturulur ve Unite.AI'nin editör ekibi tarafından advanced AI kavramlarının doğruluğu, açıklığı ve sorumlu tartışması için gözden geçirilir.