Μοντέλα και πλατφόρμες AI

Η Alibaba Εκκινεί το Qwen-Image-3.0 Χωρίς Βέβαιες Μέτρησεις ή Βαρύτητες

mm
Προσθέστε το Unite.AI στις προτιμώμενες πηγές σας στο Google

Η ομάδα Qwen της Alibaba έκδωσε το Qwen-Image-3.0 στις 21 Ιουλίου 2026, την τρίτη γενιά του μοντέλου δημιουργίας εικόνων, και κατασκεύασε την ανακοίνωση γύρω από ένα μόνο στόχο: να κάνει τις δημιουργημένες εικόνες πρακτικές enough για να χρησιμοποιηθούν ως εργαλείο εργασίας αντί για απλά να τις κοιτάξεις. Η ανακοίνωση είναι μια γκαλερί του τι μπορεί να σχεδιάσει το σύστημα — πυκνές σελίδες εφημερίδων, πολλαπλά infographics και ακαδημαϊκές εργασίες γεμάτες μαθηματικές σημειώσεις. Τι δεν περιλαμβάνει είναι ένα πίνακα βεβαίων μετρήσεων, μια κάρτα μοντέλου ή μια τεχνική αναφορά για να υποστηρίξει οποιαδήποτε από αυτές.

Αυτή η απουσία είναι η ιστορία. Οι ισχυρισμοί του Qwen-Image-3.0 βασίζονται εξ ολοκλήρου σε εικόνες που η εταιρεία επέλεξε να δημοσιεύσει, και τα προηγούμενα μοντέλα της ίδιας σειράς έθεσαν υψηλότερο εμπόδιο για αποδεικτικά στοιχεία από ότι αυτό το μοντέλο.

Τι ισχυρίζεται το μοντέλο ότι μπορεί να κάνει

Η ομάδα Qwen οργανώνει την έκδοση γύρω από τρεις ικανότητες. Η πρώτη είναι η αντιμετώπιση μακρών, λεπτομερών εντολών: το μοντέλο δέχεται εντολές μέχρι 4.500 token, το οποίο η εταιρεία λέει ότι του επιτρέπει να συνθέτει εικόνες πυκνές σε πληροφορίες σε μια seule διαδικασία. Το κεντρικό του παράδειγμα είναι ένα πλέγμα 3×3 από μη σχετικά infographics — ένα διαγραμματικό σχήμα φυσικής, μια απόδειξη θεωρίας ομάδων, μια εξήγηση βιολογίας και έξι άλλες — που η Alibaba λέει ότι παράχθηκε από μια εντολή 3.700 token αντί να συναρμολογηθεί από ξεχωριστές εικόνες. Ένα άλλο παράδειγμα ενσωματώνει διεπαφές μέσα σε άλλες, τοποθετώντας einen κωδικοποιητή γύρω από ένα παράθυρο chat γύρω από μια εφαρμογή μηνυμάτων.

Η δεύτερη ισχυρισμός είναι η λεπτομέρεια. Η Alibaba λέει ότι το μοντέλο αποδίδει κείμενο τόσο μικρό όσο 10 pixels αναγνώσιμο και αναπαράγει υφές όπως το δέρμα, τα μαλλιά και το χαρτί κοντά στη φωτογραφική ποιότητα. Η ανακοίνωση δείχνει μια πλήρη σελίδα μιας ακαδημαϊκής εργασίας με多-γραμμικές εξισώσεις και μια προσομοιωμένη πρώτη σελίδα εφημερίδας, μαζί με εργασίες επεξεργασίας όπως η προσθήκη χειρόγραφων σημειώσεων και η αποκατάσταση μιας παραδοσιακής ζωγραφικής που έχει υποστεί ζημιές.

Η τρίτη είναι αυτό που η εταιρεία ονομάζει γνώση του κόσμου: εγγενής απόδοση 12 γλωσσών, αναπαραγωγή διεπαφών όπως ιστοσελίδες και ζωντανές μεταδόσεις, και η ικανότητα να ανακτήσει ζωντανούς δεδομένα από το διαδίκτυο. Ένα παράδειγμα δημιουργεί einen γραφικό για πρόγνωση καιρού για μια συγκεκριμένη πόλη και ημερομηνία, μια ασυνήθιστη κίνηση για einen γεννήτρια και μια που θολώνει τα όρια μεταξύ ενός μοντέλου εικόνας και eines εργαλείου σχεδιασμού με δεδομένα. Η Alibaba προωθεί ολόκληρο το πακέτο σε εργασίες παραγωγής περιεχομένου — διατάξεις εφημερίδων, storyboards για σύντομες δραματικές ιστορίες, mockups διεπαφών και εικόνες ηλεκτρονικού εμπορίου — το είδος των μέσων εξόδου όπου η ερώτηση της αποκάλυψης του ρόλου του AI είναι ήδη ζωντανή. Κάθε μια από αυτές τις ικανότητες, όμως, δείχνεται μέσω εξόδων που η εταιρεία επέλεξε.

Τι αφήνει η ανακοίνωση έξω

Η ανακοίνωση δεν περιλαμβάνει κανένα πίνακα βεβαίων μετρήσεων, κανένα μετρητή παραμέτρων, καμία άδεια και κανένα λήψιμο βάρος, και καμία τεχνική αναφορά που να περιγράφει πώς το μοντέλο εκπαιδεύτηκε ή δοκιμάστηκε. Οι χρήστες οδηγούνται στο Qwen Chat για να το δοκιμάσουν.

Αυτό είναι μια απόκλιση από το πώς η σειρά κυκλοφόρησε πριν. Qwen-Image 1.0 έφτασε τον Αύγουστο του 2025 με ανοιχτά βάρη υπό μια άδεια Apache 2.0 και μια τεχνική αναφορά την ίδια μέρα, και το Qwen-Image-2.0 ακολούθησε με την δική του τεχνική αναφορά. Η προηγούμενη έκδοση ανέφερε επίσης τα όριά της: δέχτηκε εντολές μέχρι περίπου 1.000 token, το οποίο καθιστά το άλμα στα 4.500 το πιο συγκεκριμένο νούμερο στην νέα έκδοση, και ένα που δεν έχει επιβεβαιωθεί από κανένα εξωτερικό μέρος.

Το κενό έχει σημασία περισσότερο για ένα μοντέλο εικόνας από ότι για ένα κειμένου. Η ποιότητα εικόνας είναι υποκειμενική, και η απόδοση κειμένου είναι ακριβώς ο άξονας όπου οι γεννήτορες τείνουν να φαίνονται ισχυροί σε χειροκίνητα demos και πιο αδύναμοι υπό συστηματικές δοκιμές. Χωρίς βάρη ή ένα σύνολο αξιολόγησης, η μόνη απόδειξη που μπορεί να ενεργήσει ένας développper είναι το δικό της ρολόι εξόδων της Alibaba. Οι ανταγωνιστές έχουν δείξει ότι μια首次 debut είναι μια επιλογή και όχι một περιορισμός: η Tencent κυκλοφόρησε HunyuanImage 3.0 ως ένα ανοιχτό-βάρους μοντέλο, και το Thinking Machines Lab κυκλοφόρησε πρόσφατα Inkling, το πρώτο ανοιχτό-βάρους πολυμορφικό μοντέλο, με βάρη.

Πού κατέταξε η προηγούμενη γενιά

Η Alibaba έχει ένα πρόσφατο και ασυνήθιστα ειλικρινές δεδομένο για το πού βρίσκονται τα μοντέλα εικόνας της. Στο Qwen-Image-Bench, μια αξιολόγηση κειμένου-σε-εικόνα που η ομάδα Qwen δημοσίευσε, το προηγούμενο flagship, Qwen Image 2.0 Pro, κατέταξε πέμπτο συνολικά. Το GPT Image 2 της OpenAI ηγήθηκε της κατάταξης, με τα μοντέλα Nano Banana της Google και το GPT Image 1.5 της OpenAI να συμπληρώνουν τις τέσσερις πρώτες θέσεις. Η αξιολόγηση βασίζεται σε ένα αυτοματοποιημένο μοντέλο κριτή που οι συγγραφείς λένε ότι ακολουθεί στενά τους ανθρώπινους κριτές, αλλά παραμένει δική της δοκιμή, και αξιολόγησε την προηγούμενη γενιά, όχι το 3.0.

Αυτό το πλαίσιο εργάζεται ενάντια στην ανάγνωση του νέου μοντέλου ως ένα άλμα στο μπροστινό μέρος του πεδίου. Μια πέμπτη θέση που ξεκινά το Qwen-Image-3.0 αφήνει χώρο για να ισχυριστεί πραγματικές κέρδη, αλλά η ανακοίνωση δεν προσφέρει κανένα μετρημένο τρόπο να τα επιβεβαιώσει. Τα σήματα που αξίζει να παρακολουθήσουμε είναι εάν η Alibaba δημοσιεύσει βάρη και μια κάρτα μοντέλου, όπως έκανε για κάθε προηγούμενη έκδοση του Qwen-Image, και εάν ανεξάρτητες αξιολογήσεις υποστηρίξουν τις ισχυρισίες για μακρές εντολές και μικρό κείμενο. Μέχρι να γίνει αυτό, το μόνο που μπορεί να πει είναι ότι το Qwen-Image-3.0 φαίνεται ισχυρό στις εικόνες που η δημιουργός του επέλεξε να δείξει.

Ο Jonas Reeve είναι ένας αναλυτής που δημιουργείται από AI στη Unite.AI, με επίκεντρο την γνωστική AI, την τεχνητή γενική νοημοσύνη (AGI) και τις θεωρητικές βάσεις της μηχανικής νοημοσύνης. Το έργο του εξετάζει πώς η μάθηση, ο συλλογισμός, η μνήμη και η αφαίρεση εμφανίζονται και σε βιολογικά και τεχνητά συστήματα, δημιουργώντας συνδέσεις μεταξύ σύγχρονων αρχιτεκτονικών AI και μακροχρόνιων ερωτημάτων στις γνωστικές επιστήμες και τη φιλοσοφία του νου. Με μια концепτουαλιστική και αναστοχαστική προσέγγιση, ο Jonas εξετάζει πλαισιά όπως τα μοντέλα συλλογισμού, τα συστήματα agentic, η αναδυόμενη γνωστική και η θεωρία ευθυγράμμισης, με στόχο να αποσαφηνίσει τι σημαίνει πραγματικά η πρόοδος προς την AGI - και τι όχι. Αντί να κυνηγά χρονοδιαγράμματα ή υπεροπτικές εκφράσεις, τονίζει τις αρχές, τη концепτουαλιστική αυστηρότητα και τα όρια των τρεχόντων μοντέλων. Τα άρθρα που γράφονται από τον Jonas Reeve δημιουργούνται από AI και αναθεωρούνται από την редакτική ομάδα της Unite.AI για να διασφαλιστεί η ακρίβεια, η σαφήνεια και η υπεύθυνη συζήτηση για προηγμένα концеп AI.