Model dan platform AI
GLM-5.3 Mencetak Skor 60 pada Artificial Analysis Intelligence Index, Menyamai Kimi K3

GLM-5.3 milik Z.ai telah dievaluasi oleh Artificial Analysis dengan skor 60 pada Intelligence Index-nya, menurut laporan evaluator independen pada 18 Agustus 2026, menempatkan model penalaran terbaru laboratorium China tersebut sejajar dengan Kimi K3 milik Moonshot AI dan tiga poin di belakang Claude Opus 5 milik Anthropic, pemimpin saat ini dengan skor 63.
Skor ini mencakup GLM-5.3 yang berjalan pada upaya penalaran maksimum, pengaturan yang direkomendasikan Z.ai untuk pekerjaan pemrograman. Dengan skor 60, model ini berada jauh di atas median 35 dari 181 model dalam kelas perbandingannya, dan menempati peringkat kedelapan secara keseluruhan dalam kelas tersebut.
Hasil ini merupakan pembacaan independen pertama pada model yang Z.ai merilis pada 14 Agustus 2026 dengan konstruksi yang tidak biasa: GLM-5.3 menggunakan model dasar yang sama dengan GLM-5.2, dengan setiap peningkatan kemampuan berasal dari pelatihan lanjutan (post‑training) bukan dari proses pra‑pelatihan baru.
Bagaimana GLM-5.3 Tiba di Sini
Posting rilis Z.ai menjelaskan satu bulan skala pembelajaran penguatan pada lingkungan tugas jangka panjang: lebih banyak lingkungan, lebih beragam tugas, lebih banyak komputasi, semuanya pada tumpukan pelatihan yang dibangun laboratorium untuk GLM-5.2. Perusahaan melaporkan bahwa pendekatan tersebut meningkatkan Terminal‑Bench 3.0 dari 4.6 menjadi 28.3 dan DeepSWE v1.1 dari 46.2 menjadi 66.9, serta posting mereka sendiri mendokumentasikan beragam hasil di bidang pemrograman, keamanan siber, dan benchmark agenik melawan Kimi K3, Claude Opus 4.8, Claude Fable 5, dan GPT-5.6 Sol. Unite.AI meliput peluncuran dan hasil keamanan siber emergen tersebut secara detail ketika model tersebut diluncurkan minggu lalu.
Angka Artificial Analysis memiliki bobot yang berbeda dibandingkan tabel yang dilaporkan vendor, karena evaluator menjalankan rangkaian ujiannya sendiri. Intelligence Index v4.1.1 menggabungkan sembilan evaluasi yang mencakup tugas kerja dunia nyata agenik, penggunaan alat agenik, pemrograman terminal, penalaran ilmiah dan pengetahuan, pertanyaan sains tingkat pascasarjana, penalaran fisika, keandalan pengetahuan dan halusinasi, serta penalaran konteks panjang. Skor 60 GLM-5.3 merupakan gabungan hasilnya pada seluruh rangkaian tersebut, dengan total biaya evaluasi sebesar $1,238.50 pada API Z.ai.
Di Mana GLM-5.3 Menempati Peringkat pada Papan Peringkat
Kesetaraan dengan Kimi K3 menjadi perbandingan utama. Kimi K3, dirilis 16 Juli 2026, mencetak skor 60 yang sama pada indeks dan tetap menjadi model open‑weights dengan skor tertinggi dalam peringkat Artificial Analysis, posisi yang kini dibagi oleh GLM-5.3 dalam hal skor meskipun tidak dalam lisensi. Moonshot membuka bobot Kimi K3 di bawah lisensi berjenjang pendapatan pada Juli 2026; GLM-5.3 saat ini tercatat sebagai proprietari, dengan Artificial Analysis mencatat 753 miliar parameter untuk model tersebut.
Claude Opus 5, dirilis 24 Juli 2026, masih memimpin indeks dengan skor 63. Selisih tiga poin antara GLM-5.3 dan pemimpin mencerminkan jarak yang tidak dapat dijembatani oleh siklus post‑training yang cepat, melawan frontier yang sendiri telah bergeser sejak musim semi.
Harga adalah aspek di mana kedua model dengan skor 60 sangat berbeda. GLM-5.3 dikenakan biaya $1.40 per juta token masukan dan $4.40 per juta token keluaran pada API Z.ai, dibandingkan dengan $3.00 dan $15.00 untuk Kimi K3 pada Moonshot. Per tugas Intelligence Index, biaya tersebut menjadi $0.68 untuk GLM-5.3 versus $0.84 untuk Kimi K3 dan $2.34 untuk Claude Opus 5. GLM-5.3 mencapai skornya dengan biaya per tugas terendah di antara ketiganya, meskipun juga merupakan yang paling verbose dalam grup, menghasilkan 170 juta token keluaran dalam rangkaian evaluasi dibandingkan median 72 juta dalam kelasnya.
Apa yang Akan Dirilis Selanjutnya
GLM-5.3 tersedia melalui API Z.ai dan telah diluncurkan kepada semua pelanggan GLM Coding Plan. Model ini memerlukan fitur thinking diaktifkan, dengan tiga tingkat upaya, dan Z.ai memperingatkan bahwa aplikasi yang masih memanggilnya dengan thinking dinonaktifkan akan gagal hingga dimigrasikan.
Bobot model merupakan bagian yang tersisa. Z.ai berkomitmen untuk merilisnya dua minggu setelah peluncuran pada 14 Agustus 2026, setelah evaluasi keamanan dan penguatan selesai, yang akan menempatkan GLM-5.3 bersama Kimi K3 sebagai opsi open‑weights pada skor 60 di indeks, dengan harga per token kira‑kira setengahnya.












