Μοντέλα και πλατφόρμες AI
GLM-5.3 καταγράφει 60 στον Δείκτη Νοημοσύνης του Artificial Analysis, ταιριάζοντας με το Kimi K3

Το GLM-5.3 της Z.ai έχει αξιολογηθεί από το Artificial Analysis με 60 στον Δείκτη Νοημοσύνης του, όπως ανέφερε ο ανεξάρτητος αξιολογητής στις 18 Αυγούστου 2026, τοποθετώντας το νεότερο μοντέλο λογικής του κινέζιου εργαστηρίου στο ίδιο επίπεδο με το Kimi K3 της Moonshot AI και τρία σημεία πίσω από το Claude Opus 5 της Anthropic, ο τρέχων ηγέτης με 63.
Η βαθμολογία καλύπτει το GLM-5.3 που λειτουργεί με τη μέγιστη προσπάθεια λογικής, τη ρύθμιση που η Z.ai συνιστά για κωδικοποίηση. Στο 60, βρίσκεται πολύ πάνω από τη μέση τιμή των 35 των 181 μοντέλων στην κατηγορία σύγκρισης, και είναι το όγδοο στην κατηγορία συνολικά.
Το αποτέλεσμα είναι η πρώτη ανεξάρτητη αξιολόγηση ενός μοντέλου που η Z.ai κυκλοφόρησε στις 14 Αυγούστου 2026 με ασυνήθιστη κατασκευή: το GLM-5.3 χρησιμοποιεί το ίδιο βασικό μοντέλο με το GLM-5.2, με κάθε βελτίωση δυνατότητας να προέρχεται από μετα-εκπαίδευση αντί για νέα προεκπαίδευση.
Πώς έφτασε το GLM-5.3 εδώ
Η ανακοίνωση κυκλοφορίας της Z.ai περιγράφει ένα μήνα κλιμάκωσης ενισχυτικής μάθησης σε περιβάλλοντα εργασιών μακράς προοπτικής: περισσότερα περιβάλλοντα, πιο ποικίλες εργασίες, περισσότερη υπολογιστική ισχύ, όλα στο σύστημα εκπαίδευσης που το εργαστήριο δημιούργησε για το GLM-5.2. Η εταιρεία ανέφερε ότι η προσέγγιση αυτή μετακίνησε το Terminal-Bench 3.0 από 4.6 σε 28.3 και το DeepSWE v1.1 από 46.2 σε 66.9, και η δική της ανάρτηση καταγράφει μια σειρά αποτελεσμάτων σε κωδικοποίηση, κυβερνοασφάλεια και αξιολογήσεις πράκτορα σε σύγκριση με το Kimi K3, το Claude Opus 4.8, το Claude Fable 5 και το GPT-5.6 Sol. Η Unite.AI κάλυψε την κυκλοφορία και τα αναδυόμενα αποτελέσματα στην κυβερνοασφάλεια λεπτομερώς όταν το μοντέλο κυκλοφόρησε την περασμένη εβδομάδα.
Ο αριθμός του Artificial Analysis έχει διαφορετικό βάρος από εκείνους τους πίνακες που αναφέρουν οι προμηθευτές, επειδή ο αξιολογητής τρέχει τη δική του σειρά αξιολογήσεων. Ο Δείκτης Νοημοσύνης v4.1.1 συγκεντρώνει εννέα αξιολογήσεις που καλύπτουν εργασίες πράκτορα στον πραγματικό κόσμο, χρήση εργαλείων πράκτορα, κωδικοποίηση τερματικού, επιστημονική λογική και γνώση, ερωτήσεις επιστήμης επιπέδου μεταπτυχιακού, λογική φυσικής, αξιοπιστία γνώσης και ψευδαισθήσεις, καθώς και λογική μακράς συμφραζόμενης. Το 60 του GLM-5.3 είναι το σύνθετο αποτέλεσμα της εκτέλεσής του σε αυτή τη σειρά, με συνολικό κόστος αξιολόγησης $1,238.50 μέσω του API της Z.ai.
Πού κατατάσσεται το GLM-5.3 στον πίνακα κατάταξης
Η ισοδυναμία με το Kimi K3 είναι η κύρια σύγκριση. Kimi K3, κυκλοφόρησε 16 Ιουλίου 2026, καταγράφει το ίδιο 60 στον δείκτη και παραμένει το κορυφαίο μοντέλο ανοικτών βαρών στην κατάταξη του Artificial Analysis, θέση που το GLM-5.3 τώρα μοιράζεται ως σκορ, αν και όχι ως άδεια. Η Moonshot άνοιξε τα βάρη του Kimi K3 υπό άδεια με βάση τα έσοδα τον Ιούλιο 2026· το GLM-5.3 είναι προς το παρόν καταχωρημένο ως ιδιόκτητο, με το Artificial Analysis να καταγράφει 753 δισεκατομμύρια παραμέτρους για το μοντέλο.
Claude Opus 5, κυκλοφόρησε 24 Ιουλίου 2026, εξακολουθεί να ηγείται του δείκτη με 63. Το κενό τριών σημείων μεταξύ του GLM-5.3 και του ηγέτη είναι η απόσταση που ένας γρήγορος κύκλος μετα-εκπαίδευσης δεν κατάφερε να καλύψει, ενάντια σε ένα όριο που έχει μετατοπιστεί από την άνοιξη.
Η τιμή είναι το σημείο όπου τα δύο μοντέλα με 60 διαφέρουν έντονα. Το GLM-5.3 κοστίζει $1.40 ανά εκατομμύριο εισερχόμενα tokens και $4.40 ανά εκατομμύριο εξερχόμενα tokens μέσω του API της Z.ai, έναντι $3.00 και $15.00 για το Kimi K3 στο Moonshot. Ανά εργασία του Δείκτη Νοημοσύνης, αυτό αντιστοιχεί σε $0.68 για το GLM-5.3 έναντι $0.84 για το Kimi K3 και $2.34 για το Claude Opus 5. Το GLM-5.3 φθάνει στο σκορ του με το χαμηλότερο κόστος ανά εργασία από τα τρία, αν και είναι επίσης το πιο παραγωγικό της ομάδας, παράγοντας 170 εκατομμύρια εξερχόμενα tokens στην αξιολογητική σειρά έναντι 72 εκατομμυρίων μέσου στην κατηγορία του.
Τι θα κυκλοφορήσει επόμενα
Το GLM-5.3 είναι διαθέσιμο μέσω του API της Z.ai και έχει διανεμηθεί σε όλους τους συνδρομητές του GLM Coding Plan. Το μοντέλο απαιτεί ενεργοποίηση της λειτουργίας σκέψης, με τρία επίπεδα προσπάθειας, και η Z.ai προειδοποιεί ότι οι εφαρμογές που το καλούν με απενεργοποιημένη τη σκέψη θα αποτύχουν μέχρι να μεταφερθούν.
Τα βάρη είναι το υπόλοιπο κομμάτι. Η Z.ai έχει δεσμευτεί να τα κυκλοφορήσει δύο εβδομάδες μετά την κυκλοφορία της 14 Αυγούστου 2026, μόλις ολοκληρωθεί η αξιολόγηση ασφαλείας και η ενίσχυση, κάτι που θα τοποθετήσει το GLM-5.3 δίπλα στο Kimi K3 ως επιλογή ανοικτών βαρών στο σημείο 60 του δείκτη, με περίπου τη μισή τιμή ανά token.












