Μοντέλα και πλατφόρμες AI

Cerebras τρέχει το GPT-5.6 Sol της OpenAI με 750 διακριτικά ανά δευτερόλεπτο στη νέα κατηγορία Ultrafast

mm
Προσθέστε το Unite.AI στις προτιμώμενες πηγές σας στο Google

Η Cerebras (CBRS ) τρέχει πλέον το κορυφαίο μοντέλο της OpenAI με ταχύτητα που καμία υπηρεσία GPU cloud δεν έχει αντιστοιχίσει δημοσίως. Στις 13 Αυγούστου 2026, ο κατασκευαστής τσιπ σε κλίμακα wafer‑scale ανακοίνωσε ότι τροφοδοτεί το GPT‑5.6 Sol σε μια νέα κατηγορία υπηρεσιών της OpenAI που ονομάζεται Ultrafast, παρέχοντας έως 750 διακριτικά εξόδου ανά δευτερόλεπτο και, σύμφωνα με την OpenAI, τρέχοντας το μοντέλο έως και 14 × πιο γρήγορα από την τυπική επεξεργασία. Η Ultrafast λανσάρει αρχικά στο API της OpenAI ως περιορισμένη προεπισκόπηση για μια επιλεγμένη ομάδα πελατών, με την πρόσβαση να επεκτείνεται καθώς αυξάνεται η χωρητικότητα.

Η κεντρική αξίωση είναι συγκεκριμένη: υπερπροηγμένη νοημοσύνη χωρίς την τιμή της ταχύτητας. Το GPT‑5.6 Sol είναι το πιο ικανό μοντέλο της OpenAI, και στο πυρίσμα της Cerebras παράγει διακριτικά αρκετά γρήγορα ώστε να ενσωματώνεται σε προϊόντα πραγματικού χρόνου αντί να λειτουργεί πίσω από μια νυχτερινή παρτίδα. Και οι δύο εταιρείες παρουσιάζουν την κατηγορία ως την εξάλειψη του συμβιβασμού μεταξύ ενός μοντέλου αρκετά έξυπνου για εργασίες υψηλού κινδύνου και ενός τόσο γρήγορου ώστε να χρησιμοποιείται ενώ η εργασία εξακολουθεί να εκτελείται.

Οι Αριθμοί Ταχύτητας Πίσω από την Ultrafast

Το νούμερο των 750 διακριτικών εξόδου ανά δευτερόλεπτο είναι το κύριο σημείο, αλλά οι πιο ενδεικτικές συγκρίσεις είναι οι άμεσες δοκιμές που δημοσίευσε η Cerebras. Σε σύγκριση με τις ταχύτητες εξόδου που ανέφερε η Artificial Analysis, η εταιρεία δηλώνει ότι το GPT‑5.6 Sol στην Ultrafast λειτουργεί 11 × πιο γρήγορα από το Claude Fable 5 και 5 × πιο γρήγορα από το Opus 4.8 σε λειτουργία Fast.

Η Cerebras έβαλε επίσης την κατηγορία σε πλήρη δοκιμή του Humanity’s Last Exam, ενός benchmark με 2 500 ερωτήσεις επιπέδου διδακτορικού. Το GPT‑5.6 Sol στην Ultrafast απάντησε σε όλες τις 2 500 ερωτήσεις σε 11 ώρες και 11 λεπτά· το Claude Fable 5 χρειάστηκε 78 ώρες και 27 λεπτά για να φτάσει σε συγκρίσιμα συμπεράσματα: σχεδόν 7 × πιο αργό, σύμφωνα με την Cerebras. Στο GDP‑Val, ένα benchmark για οικονομικά πολύτιμη γνώση, η εταιρεία αναφέρει βελτίωση 5,6 × στην απόδοση από άκρο σε άκρο σε σχέση με την τυπική επεξεργασία, χωρίς υποβάθμιση της ποιότητας.

Αυτές είναι αξιολογήσεις που διεξάγονται από τον προμηθευτή, και η Cerebras είναι σαφής σχετικά με αυτό: η σύγκριση Humanity’s Last Exam πραγματοποιήθηκε από την Cerebras στις 10 Ιουλίου και 13‑15 Ιουλίου 2026, ενώ το νούμερο του GDP‑Val προέρχεται από τις δικές της δοκιμές της 31 Ιουλίου 2026. Θεωρήστε τα ως δικές της μετρήσεις, όχι ανεξάρτητα αποτελέσματα.

Γιατί το Chip Wafer‑Scale Κερδίζει στην Καθυστέρηση

Ο μηχανισμός είναι σημαντικός εδώ, επειδή εξηγεί γιατί ένας σχετικά μικρός κατασκευαστής τσιπ εξυπηρετεί το μεγαλύτερο μοντέλο της OpenAI με ταχύτητες που οι ανταγωνιστές GPU δεν έχουν φτάσει. Η γρήγορη επαγωγή σε μεγάλο μοντέλο είναι θεμελιωδώς ένα πρόβλημα μετακίνησης δεδομένων: στα GPU, τα βάρη του μοντέλου πρέπει να μεταφέρονται επανειλημμένα μεταξύ μνήμης εντός τσιπ και αποθήκευσης εκτός τσιπ για τη δημιουργία κάθε επόμενου διακριτικού, και το εύρος ζώνης μνήμης γίνεται το στενό λαιμό.

Η απάντηση της Cerebras είναι η εξάλειψη αυτής της κίνησης. Η Wafer‑Scale Engine της ενσωματώνει 44 GB SRAM σε ένα μόνο τσιπ μεγέθους wafer, ώστε τα βάρη του μοντέλου να παραμένουν εντός τσιπ και τα διακριτικά να ρέουν μέσω των επιπέδων σε αγωγούς διασυνδεδεμένων wafer χωρίς διακοπή. Επειδή τα βάρη δεν αφήνουν ποτέ το πυρίσμα, η προσέγγιση κλιμακώνεται με το μέγεθος του μοντέλου — που αποτελεί το επιχείρημα της εταιρείας ότι το πλεονέκτημα ταχύτητας παραμένει καθώς τα μοντέλα frontier μεγαλώνουν. Για την οικονομία της επαγωγής, αυτό είναι το κύριο θέμα: το κόστος και η καθυστέρηση εξυπηρέτησης ενός μοντέλου κυριαρχούνται από το πόσο γρήγορα μπορείτε να τροφοδοτήσετε τα βάρη στον υπολογισμό, και η διατήρηση 44 GB εντός ενός ντιέ επιτίθεται άμεσα σε αυτό.

Συνεργασία 10 Δισεκατομμυρίων Δολαρίων Φθάνει στο Κορυφαίο Προϊόν

Η Ultrafast είναι το πιο εμφανές προϊόν μέχρι τώρα μιας σχέσης που χτίζεται εδώ και μήνες. Η OpenAI επέλεξε την Cerebras για 10 δισεκατομμύρια δολάρια σε υπολογισμούς χαμηλής καθυστέρησης νωρίτερα το 2026, και αυτή η κυκλοφορία τοποθετεί αυτή τη χωρητικότητα πίσω από το κορυφαίο μοντέλο της εταιρείας αντί για ένα μικρότερο ή εξειδικευμένο. Η OpenAI περιγράφει την Ultrafast ως «το επόμενο βήμα» στη συνεργασία για να φέρει επαγωγή εξαιρετικά χαμηλής καθυστέρησης στην πλατφόρμα της.

Για την Cerebras, η τοποθέτηση είναι σημαντική. Η νεοσύστατη εταιρεία υποστηρίζει εδώ και πολύ καιρό ότι η αρχιτεκτονική wafer‑scale είναι η κατάλληλη μορφή για επαγωγή, ακόμη και όταν το κέντρο βαρύτητας της αγοράς βρίσκεται στους προμηθευτές GPU — ένας ανταγωνισμός που διαδραματίζεται σε όλο το χώρο των επιταχυντών καθώς οι υπάρχοντες μεταβαίνουν στο να ενσωματώνουν μοντέλα απευθείας στο πυρίσμα τους. Η κατάληξη του επιπέδου εξυπηρέτησης για το κορυφαίο προϊόν της OpenAI δίνει στην Cerebras έναν λογαριασμό αναφοράς παραγωγής στην κορυφή της αγοράς. Το ίδιο το μοντέλο αποτελεί την άγκυρα της οικογένειας GPT‑5.6 που κυκλοφόρησε η OpenAI (το Sol ως κορυφαίο, μαζί με το ισορροπημένο Terra και το οικονομικό Luna), έτσι η Ultrafast συνδέει την Cerebras στην αρχή αυτής της σειράς.

Ποιοι Το Λαμβάνουν και Για Τι Χρησιμοποιείται

Η OpenAI τοποθετεί την κατηγορία σε εργασίες που απαιτούν άμεση απόκριση και υψηλό ρίσκο: ανταπόκριση σε περιστατικά ενώ μια διακοπή λειτουργίας εξακολουθεί να εξελίσσεται, χρηματοοικονομική έρευνα ενώ οι συνθήκες της αγοράς μεταβάλλονται, υποστήριξη πελατών και φωνητικές υπηρεσίες σε πραγματικό χρόνο, εμπορικές δραστηριότητες και ζωντανά βρόχους έρευνας που παλαιότερα εκτελούνταν τη νύχτα. Η πρώιμη πρόσβαση έχει δοθεί σε εταιρείες από τους τομείς του προγραμματισμού, του εμπορίου και των χρηματοοικονομικών, όπως η Jane Street, η Podium, η Basis και η Rogo.

«Η αύξηση στην ταχύτητα που προσφέρει η Cerebras είναι εντυπωσιακή», δήλωσε ο John Crepezzi, AI Assistants στη Jane Street, στην ανακοίνωση της OpenAI. «Δίνει τη δυνατότητα διαφορετικών τρόπων χρήσης των μοντέλων και καθιστά πρακτικό για τους προγραμματιστές να εργάζονται με πιο συγκεντρωμένο και παραγωγικό τρόπο μαζί τους».

Η OpenAI διατηρεί τη διάθεση περιορισμένη επίτηδες. Η εταιρεία λέει ότι χρησιμοποιεί την περίοδο προεπισκόπησης για να μάθει πού μια αλλαγή ταχύτητας κατά τάξη μεγέθους δημιουργεί τη μεγαλύτερη αξία, και θα επεκτείνει την πρόσβαση καθώς η χωρητικότητα αυξάνεται. Και οι δύο, OpenAI και Cerebras, δέχονται εγγραφές για ενημερώσεις καθώς η προεπισκόπηση διευρύνεται.

Τι Συμβαίνει Στη Σύντομη Μελλοντική

Το βραχυπρόθεσμο παρατηρήσιμο είναι η χωρητικότητα, όχι η ικανότητα. Η Ultrafast είναι μια περιορισμένη προεπισκόπηση, και και οι δύο εταιρείες συνδέουν τυχόν ευρύτερη διαθεσιμότητα με την αύξηση της χωρητικότητας αντί για μια σταθερή ημερομηνία — έτσι ο ρυθμός επέκτασης είναι το στοιχείο που πρέπει να παρακολουθήσουμε. Το μακροπρόθεσμο ερώτημα είναι αν το πλεονέκτημα μνήμης εντός τσιπ της Cerebras παραμένει καθώς τα μοντέλα της OpenAI κλιμακώνουν, κάτι που αποτελεί ακριβώς το στοίχημα πάνω στο οποίο βασίζεται η αρχιτεκτονική wafer‑scale.

Ο Theo Nash είναι ένας ειδικός που δημιουργήθηκε από AI στο Unite.AI, που καλύπτει την υποδομή AI, τον υπολογισμό και τα συστήματα υλικού που τροφοδοτούν την σύγχρονη τεχνητή νοημοσύνη. Το έργο του επικεντρώνεται στις τεχνικές βάσεις πίσω από τις μεγάλες εργασίες AI, συμπεριλαμβανομένων των κέντρων δεδομένων, των επιταχυντών, των δικτύων και των στοιχείων λογισμικού που τα συνδέουν.
Με μια αναλυτική και μηχανική προοπτική, ο Theo εξετάζει πώς οι προόδους στις GPU, το εξειδικευμένο σιλικόνιο, τις αρχιτεκτονικές μνήμης και τα κατανεμημένα συστήματα επιτρέπουν новые γενιές μοντέλων AI. Δίνει ιδιαίτερη προσοχή στις ανταλλαγές απόδοσης, την ενεργειακή αποτελεσματικότητα, την κλιμακωσιμότητα και τις πρακτικές περιορισμοί που διαμορφώνουν την ανάπτυξη της υποδομής AI στον πραγματικό κόσμο.
Οι άρθρα που γράφονται από τον Theo Nash δημιουργούνται από AI και αναθεωρούνται από την редакτική ομάδα του Unite.AI για να διασφαλίσουν την τεχνική ακρίβεια, τη σαφήνεια και την υπεύθυνη κάλυψη του ταχέως εξελισσόμενου τοπίου υπολογισμού AI.