Μοντέλα και πλατφόρμες AI

Η Alibaba ισχυρίζεται ότι το Qwen3.8 υστερεί μόνο έναντι του Claude Fable 5 της Anthropic

mm
Προσθέστε το Unite.AI στις προτιμώμενες πηγές σας στο Google

Η Alibaba έχει προεπισκόπηση του πιο ικανού μοντέλου στη σειρά Qwen και λέει ότι κατατάσσεται δεύτερο μεταξύ των συστημάτων της υπεραξίας του κόσμου, πίσω μόνο από το Claude Fable 5 της Anthropic. Η αξίωση έφτασε χωρίς αυτό που θα επέτρεπε σε οποιονδήποτε να το ελέγξει: κανένα αποτέλεσμα συγκριτικής αξιολόγησης, καμία κάρτα μοντέλου και καμία ανεξάρτητη αξιολόγηση.

Το μοντέλο, μια προεπισκόπηση ονομάζεται Qwen3.8-Max-Preview, έγινε ζωντανό στο λογαριασμό της ομάδας Qwen σε μια ανάρτηση στο X κατά τη διάρκεια της Παγκόσμιας Συνόδου για την Τεχνητή Νοημοσύνη στη Σαγκάη στις 19 Ιουλίου 2026, περιγραφόμενο ως “δεύτερο μόνο στο Fable 5” και συγκρίσιμο με τα ηγετικά σύστηματα της υπεραξίας. Φέρει 2,4 τρισεκατομμύρια παραμέτρους και είναι το πρώτο μοντέλο Qwen που ξεπερνά το όριο των τρισεκατομμυρίων παραμέτρων και μπορεί να χειρίζεται εικόνες, βίντεο και έγγραφα, και όχι μόνο κείμενο — μια μετατόπιση που μεταφέρει το Qwen από μια μηχανή κειμένου προς τον τύπο του γενικού συστήματος που οι αμερικανικοί ανταγωνιστές του ήδη διαθέτουν.

Η προεπισκόπηση είναι διαθέσιμη τώρα μέσω του Token Plan της Alibaba και των εργαλείων ανάπτυξης Qoder και QoderWork με 10% της τυπικής τιμής κατά τη διάρκεια της δοκιμής, με ανοιχτές βαρύτητες που υποσχέθηκαν αλλά χωρίς ημερομηνία κυκλοφορίας ή όρους άδειας.

Μια κατάταξη χωρίς πίνακα βαθμολογίας

Ο αριθμός παραμέτρων περιγράφει το μέγεθος του μοντέλου, όχι την ικανότητά του. Ένας αριθμός 2,4 τρισεκατομμυρίων παραμέτρων δεν λέει τίποτα για το πώς το Qwen3.8 συλλογίζει, σχεδιάζει ή αντέχει στην πραγματική εργασία — αυτό είναι για το οποίο οι βελτιστοποιήσεις και οι αξιολογήσεις είναι, και είναι ακριβώς αυτό που η Alibaba άφησε έξω.

Η εταιρεία δημοσίευσε καμία κάρτα μοντέλου, καμία καταμέτρηση των ενεργών παραμέτρων ανά ερώτημα και κανένα αποτέλεσμα σε επίπεδο εργασιών, ούτε καν ενάντια στο δικό της προηγούμενο μοντέλο. Περιέγραψε το Qwen3.8-Max μόνο ως “συνεχώς εξελισσόμενο”. Κάθε ένα από αυτά τα κενά έχει σημασία για τον αγοραστή: μια καταμέτρηση ενεργών παραμέτρων σηματοδοτεί πόσο υπολογιστική ισχύ καίει μια ερώτηση, μια μοντέλο κάρτα τεκμηριώνει τα δεδομένα εκπαίδευσης και τα τεστ ασφαλείας, και τα αποτελέσματα επιπέδου εργασιών δείχνουν πού ένα μοντέλο είναι ισχυρό και πού όχι.

Αυτή η σιωπή διαφέρει από το πώς η Alibaba έστειλε το τελευταίο της μοντέλο. Το Qwen3.7-Max έφτασε τον Μάιο του 2026 με ένα πλήρες σύνολο δημοσιευμένων αριθμών, συμπεριλαμβανομένου ενός σκορ 56,6 στο ανεξάρτητο Artificial Analysis Intelligence Index. Ένας πίνακας βελτιστοποίησης ενός προμηθευτή είναι μια αξίωση παρά μια ανεξάρτητη μέτρηση, αλλά τουλάχιστον δίνει στους εξωτερικούς αξιολογητές κάτι να ελέγξουν — το είδος της σκέψης που έχει ανατρέψει πολλές φορές υποθέσεις για το τι μπορούν πραγματικά να κάνουν αυτά τα συστήματα. Η σύγκριση με το Fable 5 δεν προσφέρει τίποτα να ελέγξουν.

Η ανεξάρτητη εικόνα που υπάρχει δείχνει την αντίθετη κατεύθυνση. Καμία εξωτερική λίστα δεν έχει κατατάξει ακόμη το Qwen3.8, και το πιο πρόσφατο μοντέλο Qwen που αξιολογήθηκε, το Qwen3.7-Max, βρίσκεται μακριά από την κορυφή της λίστας LMArena, η κατάταξη που διαμορφώνεται από ψηφοφορία του κοινού όπου το Fable 5 κατέχει την πρώτη θέση. Η Alibaba ζητά από τους αγοραστές να αποδεχτούν ένα άλμα από το μέσο της ομάδας στη δεύτερη θέση στον κόσμο με τη λέξη της μόνο.

Ο αγώνας της υπεραξίας της Κίνας

Ο χρονοπρογραμματισμός δεν είναι τυχαίος. Η Moonshot AI παρουσίασε το δικό της μοντέλο 2,8 τρισεκατομμυρίων παραμέτρων, Kimi K3, τρεις ημέρες πριν από την προεπισκόπηση της Alibaba, μεταφέροντας τους προγραμματιστές της Κίνας στην κατηγορία των τρισεκατομμυρίων παραμέτρων που μέχρι πρόσφατα ανήκε στα μεγαλύτερα αμερικανικά εργαστήρια. Ο ανταγωνισμός είναι εν μέρει εσωτερικός — η Alibaba είναι μεταξύ των επενδυτών της Moonshot, γεγονός που αφήνει δύο από τα δικά της στοιχήματα να ανταγωνίζονται για τον τίτλο του ισχυρότερου ανοιχτού μοντέλου της Κίνας. Και οι δύο εκδόσεις βασίζονται στην ανοιχτή στρατηγική που τα αμερικανικά εργαστήρια τώρα αγωνίζονται να ισορροπήσουν.

Η αντίθεση μεταξύ των δύο εκδόσεων εντείνει το σημείο για τις αποδείξεις. Το Kimi K3 κυκλοφόρησε με τρίτη πλευρική σκέψη: η Artificial Analysis το κατέταξε τρίτο στο δείκτη νοημοσύνης, συγκρίσιμο με το Claude Opus 4.8 της Anthropic. Αυτό το είδος εξωτερικού ελέγχου είναι ακριβώς αυτό που το Qwen3.8 λείπει.

Τα κινεζικά μοντέλα έχουν κερδίσει έδαφος με τους δυτικούς προγραμματιστές εν μέρει επειδή κοστίζουν λιγότερο για να τρέξουν από τα κορυφαία αμερικανικά συστήματα, και οι αμερικανικοί νομοθέτες έχουν αρχίσει να εξετάζουν πώς να περιορίσουν την υιοθέτησή τους στο σπίτι. Για την Alibaba, τα στοιχήματα είναι ανταγωνιστικά τόσο όσο και τεχνικά. Η εταιρεία έχει περάσει το τελευταίο χρόνο θέτοντας το Qwen ως τον προεπιλεγμένο προμηθευτή AI της Κίνας, αποστέλλοντας μια σταθερή σειρά ανοιχτών μοντέλων και κατασκευάζοντας τη δική της υποδομή υπολογιστικού νέφους και εξειδικευμένο σιλικόνιο για να τα εξυπηρετήσει — μια προσπάθεια που έχει τραβήξει περισσότερους προγραμματιστές στο Qwen από σχεδόν οποιοδήποτε άλλο κινεζικό μοντέλο.

Οι αναλυτές της Bank of America (BAC ) με επικεφαλής τον Alex Liu έγραψαν ότι το Kimi K3 έχει ανεβάσει το όριο ικανοτήτων για τα κινεζικά μοντέλα και ότι η θέση της Alibaba ως ηγέτη του ανοιχτού κώδικα της χώρας μπορεί να αντιμετωπίσει φρέσκα τεστ. Οι επενδυτές δεν ενοχλήθηκαν: οι μετοχές της Alibaba ανέβηκαν έως και 5,4% την ημέρα μετά την προεπισκόπηση.

Η κατάταξη επίσης ταξίδεψε μέσω φιλικών καναλιών. Η South China Morning Post, την οποία η Alibaba κατέχει, μετέδωσε τη σύγκριση με το Fable 5 και την περιγραφή της εταιρείας του Qwen3.8 ως ενός από τα πιο ισχυρά μοντέλα που διατίθενται σήμερα. Μέχρι την Alibaba να δημοσιεύσει βελτιστοποιήσεις ή τις ανοιχτές βαρύτητες που έχει υποσχεθεί, αυτή η κατάταξη είναι μια γραμμή μάρκετινγκ παρά ένα μετρημένο αποτέλεσμα — και για τώρα οι μόνοι άνθρωποι που μπορούν να το δοκιμάσουν είναι οι προγραμματιστές που πληρώνουν την προεπισκόπηση με την εκπτωτική τιμή.

Jonas Reeve είναι ένας αναλυτής που δημιουργείται από AI στην Unite.AI, εστιάζοντας στην γνωστική AI, την τεχνητή γενική νοημοσύνη (AGI) και τα θεωρητικά θεμέλια της μηχανικής νοημοσύνης. Η δουλειά του διερευνά πώς η μάθηση, η λογική, η μνήμη και η αφαίρεση εμφανίζονται τόσο σε βιολογικά όσο και σε τεχνητά συστήματα, δημιουργώντας συνδέσεις μεταξύ των σύγχρονων αρχιτεκτονικών AI και των μακροχρόνιων ερωτήσεων στην γνωστική επιστήμη και τη φιλοσοφία του νου.

Με μια εννοιολογική και στοχαστική προσέγγιση, ο Jonas εξετάζει πλαίσια όπως μοντέλα λογικής, συστήματα πράκτορα, αναδυόμενη γνωστική λειτουργία και θεωρία ευθυγράμμισης, με στόχο να διευκρινίσει τι σημαίνει πραγματικά η πρόοδος προς την AGI — και τι δεν σημαίνει. Αντί να κυνηγά χρονοδιαγράμματα ή υπερβολές, δίνει έμφαση στις πρώτες αρχές, στην εννοιολογική αυστηρότητα και στα όρια των τρεχουσών μοντέλων.

Τα άρθρα που συντάσσει ο Jonas Reeve δημιουργούνται από AI και ελέγχονται από την ομάδα συντακτών της Unite.AI για να διασφαλιστεί η ακρίβεια, η σαφήνεια και η υπεύθυνη συζήτηση των προχωρημένων εννοιών AI.