Μοντέλα και πλατφόρμες AI

GLM-5.3 καταγράφει 60 στον Δείκτη Νοημοσύνης του Artificial Analysis, ταιριάζοντας με το Kimi K3

mm
Προσθέστε το Unite.AI στις προτιμώμενες πηγές σας στο Google

Το GLM-5.3 της Z.ai έχει αξιολογηθεί από το Artificial Analysis με 60 στον Δείκτη Νοημοσύνης του, όπως ανέφερε ο ανεξάρτητος αξιολογητής στις 18 Αυγούστου 2026, τοποθετώντας το νεότερο μοντέλο λογικής του κινέζιου εργαστηρίου στο ίδιο επίπεδο με το Kimi K3 της Moonshot AI και τρία σημεία πίσω από το Claude Opus 5 της Anthropic, ο τρέχων ηγέτης με 63.

Η βαθμολογία καλύπτει το GLM-5.3 που λειτουργεί με τη μέγιστη προσπάθεια λογικής, τη ρύθμιση που η Z.ai συνιστά για κωδικοποίηση. Στο 60, βρίσκεται πολύ πάνω από τη μέση τιμή των 35 των 181 μοντέλων στην κατηγορία σύγκρισης, και είναι το όγδοο στην κατηγορία συνολικά.

Το αποτέλεσμα είναι η πρώτη ανεξάρτητη αξιολόγηση ενός μοντέλου που η Z.ai κυκλοφόρησε στις 14 Αυγούστου 2026 με ασυνήθιστη κατασκευή: το GLM-5.3 χρησιμοποιεί το ίδιο βασικό μοντέλο με το GLM-5.2, με κάθε βελτίωση δυνατότητας να προέρχεται από μετα-εκπαίδευση αντί για νέα προεκπαίδευση.

Πώς έφτασε το GLM-5.3 εδώ

Η ανακοίνωση κυκλοφορίας της Z.ai περιγράφει ένα μήνα κλιμάκωσης ενισχυτικής μάθησης σε περιβάλλοντα εργασιών μακράς προοπτικής: περισσότερα περιβάλλοντα, πιο ποικίλες εργασίες, περισσότερη υπολογιστική ισχύ, όλα στο σύστημα εκπαίδευσης που το εργαστήριο δημιούργησε για το GLM-5.2. Η εταιρεία ανέφερε ότι η προσέγγιση αυτή μετακίνησε το Terminal-Bench 3.0 από 4.6 σε 28.3 και το DeepSWE v1.1 από 46.2 σε 66.9, και η δική της ανάρτηση καταγράφει μια σειρά αποτελεσμάτων σε κωδικοποίηση, κυβερνοασφάλεια και αξιολογήσεις πράκτορα σε σύγκριση με το Kimi K3, το Claude Opus 4.8, το Claude Fable 5 και το GPT-5.6 Sol. Η Unite.AI κάλυψε την κυκλοφορία και τα αναδυόμενα αποτελέσματα στην κυβερνοασφάλεια λεπτομερώς όταν το μοντέλο κυκλοφόρησε την περασμένη εβδομάδα.

Ο αριθμός του Artificial Analysis έχει διαφορετικό βάρος από εκείνους τους πίνακες που αναφέρουν οι προμηθευτές, επειδή ο αξιολογητής τρέχει τη δική του σειρά αξιολογήσεων. Ο Δείκτης Νοημοσύνης v4.1.1 συγκεντρώνει εννέα αξιολογήσεις που καλύπτουν εργασίες πράκτορα στον πραγματικό κόσμο, χρήση εργαλείων πράκτορα, κωδικοποίηση τερματικού, επιστημονική λογική και γνώση, ερωτήσεις επιστήμης επιπέδου μεταπτυχιακού, λογική φυσικής, αξιοπιστία γνώσης και ψευδαισθήσεις, καθώς και λογική μακράς συμφραζόμενης. Το 60 του GLM-5.3 είναι το σύνθετο αποτέλεσμα της εκτέλεσής του σε αυτή τη σειρά, με συνολικό κόστος αξιολόγησης $1,238.50 μέσω του API της Z.ai.

Πού κατατάσσεται το GLM-5.3 στον πίνακα κατάταξης

Η ισοδυναμία με το Kimi K3 είναι η κύρια σύγκριση. Kimi K3, κυκλοφόρησε 16 Ιουλίου 2026, καταγράφει το ίδιο 60 στον δείκτη και παραμένει το κορυφαίο μοντέλο ανοικτών βαρών στην κατάταξη του Artificial Analysis, θέση που το GLM-5.3 τώρα μοιράζεται ως σκορ, αν και όχι ως άδεια. Η Moonshot άνοιξε τα βάρη του Kimi K3 υπό άδεια με βάση τα έσοδα τον Ιούλιο 2026· το GLM-5.3 είναι προς το παρόν καταχωρημένο ως ιδιόκτητο, με το Artificial Analysis να καταγράφει 753 δισεκατομμύρια παραμέτρους για το μοντέλο.

Claude Opus 5, κυκλοφόρησε 24 Ιουλίου 2026, εξακολουθεί να ηγείται του δείκτη με 63. Το κενό τριών σημείων μεταξύ του GLM-5.3 και του ηγέτη είναι η απόσταση που ένας γρήγορος κύκλος μετα-εκπαίδευσης δεν κατάφερε να καλύψει, ενάντια σε ένα όριο που έχει μετατοπιστεί από την άνοιξη.

Η τιμή είναι το σημείο όπου τα δύο μοντέλα με 60 διαφέρουν έντονα. Το GLM-5.3 κοστίζει $1.40 ανά εκατομμύριο εισερχόμενα tokens και $4.40 ανά εκατομμύριο εξερχόμενα tokens μέσω του API της Z.ai, έναντι $3.00 και $15.00 για το Kimi K3 στο Moonshot. Ανά εργασία του Δείκτη Νοημοσύνης, αυτό αντιστοιχεί σε $0.68 για το GLM-5.3 έναντι $0.84 για το Kimi K3 και $2.34 για το Claude Opus 5. Το GLM-5.3 φθάνει στο σκορ του με το χαμηλότερο κόστος ανά εργασία από τα τρία, αν και είναι επίσης το πιο παραγωγικό της ομάδας, παράγοντας 170 εκατομμύρια εξερχόμενα tokens στην αξιολογητική σειρά έναντι 72 εκατομμυρίων μέσου στην κατηγορία του.

Τι θα κυκλοφορήσει επόμενα

Το GLM-5.3 είναι διαθέσιμο μέσω του API της Z.ai και έχει διανεμηθεί σε όλους τους συνδρομητές του GLM Coding Plan. Το μοντέλο απαιτεί ενεργοποίηση της λειτουργίας σκέψης, με τρία επίπεδα προσπάθειας, και η Z.ai προειδοποιεί ότι οι εφαρμογές που το καλούν με απενεργοποιημένη τη σκέψη θα αποτύχουν μέχρι να μεταφερθούν.

Τα βάρη είναι το υπόλοιπο κομμάτι. Η Z.ai έχει δεσμευτεί να τα κυκλοφορήσει δύο εβδομάδες μετά την κυκλοφορία της 14 Αυγούστου 2026, μόλις ολοκληρωθεί η αξιολόγηση ασφαλείας και η ενίσχυση, κάτι που θα τοποθετήσει το GLM-5.3 δίπλα στο Kimi K3 ως επιλογή ανοικτών βαρών στο σημείο 60 του δείκτη, με περίπου τη μισή τιμή ανά token.

Ο Jonas Reeve είναι ένας αναλυτής που δημιουργείται από AI στη Unite.AI, με επίκεντρο την γνωστική AI, την τεχνητή γενική νοημοσύνη (AGI) και τις θεωρητικές βάσεις της μηχανικής νοημοσύνης. Το έργο του εξετάζει πώς η μάθηση, ο συλλογισμός, η μνήμη και η αφαίρεση εμφανίζονται και σε βιολογικά και τεχνητά συστήματα, δημιουργώντας συνδέσεις μεταξύ σύγχρονων αρχιτεκτονικών AI και μακροχρόνιων ερωτημάτων στις γνωστικές επιστήμες και τη φιλοσοφία του νου. Με μια концепτουαλιστική και αναστοχαστική προσέγγιση, ο Jonas εξετάζει πλαισιά όπως τα μοντέλα συλλογισμού, τα συστήματα agentic, η αναδυόμενη γνωστική και η θεωρία ευθυγράμμισης, με στόχο να αποσαφηνίσει τι σημαίνει πραγματικά η πρόοδος προς την AGI - και τι όχι. Αντί να κυνηγά χρονοδιαγράμματα ή υπεροπτικές εκφράσεις, τονίζει τις αρχές, τη концепτουαλιστική αυστηρότητα και τα όρια των τρεχόντων μοντέλων. Τα άρθρα που γράφονται από τον Jonas Reeve δημιουργούνται από AI και αναθεωρούνται από την редакτική ομάδα της Unite.AI για να διασφαλιστεί η ακρίβεια, η σαφήνεια και η υπεύθυνη συζήτηση για προηγμένα концеп AI.