Μοντέλα και πλατφόρμες AI
OceanStor M900 φέρνει μνήμη περιεχομένου σε κλίμακα PB στα Huawei SuperPoDs

Η Huawei παρουσίασε OceanStor M900 Context Memory Storage στο HUAWEI CONNECT 2026 στο Σαγκάη στις 17 Σεπτεμβρίου 2026, αποκαλύπτοντας ένα σύστημα αποθήκευσης σχεδιασμένο για AI inference σε υπερκλιμακούμενα κέντρα δεδομένων. Ο David Wang, Αντιπρόεδρος του Διοικητικού Συμβουλίου και Περιστρεφόμενος Πρόεδρος της Huawei, παρουσίασε το προϊόν στην κύρια ομιλία του, και η Huawei αναφέρει ότι ένα μόνο σύμπλεγμα παρέχει 64 PB χωρητικότητα KV cache.
Σύμφωνα με τη Huawei, το σύστημα παρέχει στα SuperPoDs έναν πλήρως κοινόχρηστο χώρο μνήμης που προσφέρει χωρητικότητα σε κλίμακα PB και απόδοση σε επίπεδο TB/s, χτισμένο στο δίκτυο διασύνδεσης UnifiedBus της εταιρείας. Η κύρια ομιλία του Wang είχε τίτλο \”Advancing the Agentic World, Building a Solid Silicon Foundation\”, και η Huawei περιγράφει την κυκλοφορία ως μια στροφή στην υποδομή AI από ένα μοντέλο προσανατολισμένο στην υπολογιστική ισχύ προς πιο βαθιά συνεργασία μεταξύ υπολογισμού, δικτύου και αποθήκευσης.
Όρια μνήμης στην μεγάλης κλίμακας AI inference
Στην ανακοίνωσή της, η Huawei περιγράφει το 2026 ως το έτος κατά το οποίο η AI έχει μεταβεί από τεχνολογικές επαναστάσεις σε μεγάλης κλίμακας υλοποίηση, με τις εφαρμογές να εξελίσσονται από chatbot σε πράκτορες ικανούς να ολοκληρώνουν αυτόνομα σύνθετες εργασίες. Η εταιρεία αναφέρει ότι αυτοί οι πράκτορες έχουν ευρεία υιοθέτηση σε τομείς όπως η επιστημονική έρευνα, η υγειονομική περίθαλψη, τα χρηματοοικονομικά και οι δημόσιες υπηρεσίες, και χαρακτηρίζει αυτή τη στροφή ως την αρχή της εποχής της agentic AI.
Η Huawei δηλώνει ότι τα μεγάλα μοντέλα αυξάνονται σε παράμετρους κλίμακας 10 τρισεκατομμυρίων, ενώ τα κυρίαρχα μοντέλα ήδη υποστηρίζουν παράθυρα περιεχομένου που ξεπερνούν το ένα εκατομμύριο tokens, καθιστώντας την multi-turn inference και τις σύνθετες εργασίες το πρότυπο και οδηγώντας σε συνεχή αύξηση των δεδομένων KV cache. Καθώς αυτά τα δεδομένα συσσωρεύονται, η εταιρεία αναφέρει ότι η μνήμη ενσωματωμένη στο chip και η DRAM έχουν ωθήσει πέρα από τα όριά τους τόσο σε χωρητικότητα όσο και σε αποδοτικότητα κόστους. Μια FAQ που επισυνάπτεται στην ανακοίνωση ορίζει το KV cache ως την αποθήκευση των δεδομένων Key και Value που δημιουργούνται κατά τη διάρκεια της large-model inference, ώστε να μπορούν να επαναχρησιμοποιηθούν σε επόμενες inference, αποφεύγοντας περιττές υπολογιστικές διαδικασίες. Η Huawei περιγράφει ένα βιομηχανικό συναίνεση γύρω από την κατασκευή πολυεπίπεδης αποθήκευσης που συντονίζει τη μνήμη ενσωματωμένη στο chip, τη DRAM και τα SSDs σε έναν πλήρως κοινόχρηστο χώρο μνήμης, και δηλώνει ότι το M900 σχεδιάστηκε για να ξεπεράσει τα εμπόδια χωρητικότητας μνήμης σε υπερ-μακροπρόσθετο και multi-turn inference. Η εταιρεία επίσης χαρακτηρίζει τα SuperPoDs ως την βέλτιστη επιλογή για υποδομή AI καθώς τα μοντέλα κλιμακώνονται.
Τρεις τεχνολογίες πίσω από το M900
Για τη χωρητικότητα, η Huawei δηλώνει ότι η διασύνδεση UnifiedBus επιτρέπει στο OceanStor M900 να δημιουργήσει ένα παγκόσμιο πολυεπίπεδο KV cache σε κλίμακα PB με συνδέσεις one-hop, συγκεντρώνοντας και μοιράζοντας την cache σε ένα σύμπλεγμα με πολυεπίπεδη αποθήκευση. Ο σχεδιασμός επεκτείνει το KV cache των SuperPoD από τη μνήμη ενσωματωμένη στο chip και τη DRAM σε SSDs, επιτρέποντας σε ένα μόνο σύμπλεγμα να παρέχει 64 PB χωρητικότητα, σύμφωνα με την εταιρεία. Η Huawei αναφέρει ότι η διαθέσιμη χωρητικότητα KV cache ανά NPU αυξάνεται από gigabytes σε terabytes, επιτρέποντας την αποθήκευση, κοινή χρήση και επαναχρησιμοποίηση περισσότερου περιεχομένου, κάτι που, όπως λέει, ενισχύει σημαντικά το ποσοστό επιτυχίας του KV cache.
Για την απόδοση, η Huawei περιγράφει το OceanStor M900 ως την πρώτη αρχιτεκτονική της βιομηχανίας που ενσωματώνει την CPU, τη μονάδα ελεγκτή δικτύου και τη μονάδα ελεγκτή NAND, παρέχοντας εγγενή σημασιολογία KV που επιτρέπει συνδέσεις one-hop από τα NPUs ενός SuperPoD προς SSDs. Η εταιρεία αναφέρει ότι η εξάλειψη της μετατροπής πρωτοκόλλου και της προώθησης από την CPU μειώνει την καθυστέρηση πρόσβασης από χιλιοστά του δευτερολέπτου σε 60 μικροδευτερόλεπτα, με μείωση 90%. Η Huawei επίσης αναφέρει 40 TB/s συνολική εύρος ζώνης πρόσβασης για ένα σύμπλεγμα, αριθμό που περιγράφει ως 1,5 φορές υψηλότερο από τις λύσεις των ανταγωνιστών. Σε τυπικά σενάρια προγραμματισμού AI, η εταιρεία δηλώνει ότι η αρχιτεκτονική διπλασιάζει την απόδοση token ενός επεξεργασία cluster και μειώνει στο μισό το χρόνο μέχρι το πρώτο token.
Για το κόστος, η Huawei δηλώνει ότι το M900 χρησιμοποιεί την πρώτη στην βιομηχανία τεχνολογία προσαρμοστικής αποθήκευσης με επίγνωση KV, η οποία προβλέπει τους κύκλους ζωής του KV cache βάσει της αξίας των δεδομένων και διανέμει τα δεδομένα στα μέσα αποθήκευσης αναλόγως. Η εταιρεία αναφέρει ότι η τεχνολογία υποστηρίζει έως 24 εγγραφές δίσκου ανά ημέρα, επεκτείνει την ανθεκτικότητα των SSD κατά 16 φορές και εξασφαλίζει σταθερότητα για τρία χρόνια, μειώνοντας την αντικατάσταση μέσων και τα κόστη λειτουργίας και συντήρησης σε υποδομή μεγάλης κλίμακας inference.
Θέση προϊόντος και λεπτομέρειες εκδήλωσης
Στην FAQ της, η Huawei περιγράφει το Context Memory Storage, που αντιπροσωπεύεται από το M900, ως μια νέα υποδομή δεδομένων για SuperPoDs σε υπερκλιμακούμενα κέντρα δεδομένων, παρέχοντας μνήμη πλήρως κοινόχρηστη σε κλίμακα PB και επιτρέποντας πολυεπίπεδη αποθήκευση και αποδοτικό προγραμματισμό του KV cache μεταξύ μνήμης ενσωματωμένης στο chip, DRAM και SSDs. Η εταιρεία δηλώνει ότι η αποθήκευση μνήμης περιεχομένου θα είναι ουσιώδης για τη συνεχή βελτίωση της χωρητικότητας και της αποδοτικότητας πρόσβασης των KV cache inference σε υπερκλίμακα. Η Huawei επίσης αναφέρει ότι θα συνεχίσει να προωθεί τη συνέργεια υλισμικού-λογισμικού και την καινοτομία σε επίπεδο συστήματος για να παρέχει ανοιχτή, αποδοτική και βιώσιμη υποδομή AI για την ευφυή μετασχηματισμό σε όλους τους κλάδους.
Το HUAWEI CONNECT 2026, με θέμα \”Advancing the Agentic World\”, διεξάγεται από 17 έως 19 Σεπτεμβρίου 2026, στο Shanghai World Expo Exhibition & Convention Center και στο Shanghai Expo Center, και η ανακοίνωση αναφέρει ότι η εκδήλωση εξετάζει την AI σε επίπεδο στρατηγικής, τεχνολογίας και οικοσυστημάτων. Η επίσημη σελίδα της εκδήλωσης παραθέτει πρόγραμμα τριών κύριων ομιλιών, 20 κορυφών, περισσότερες από 60 συνεδρίες και πάνω από 200 ανοιχτές ομιλίες, με προγραμματισμένους ομιλητές όπως ο Διευθύνων Σύμβουλος της Linux Foundation, Jim Zemlin, ο Πρόεδρος της iFLYTEK, Liu Qingfeng, και ο Διευθύνων Σύμβουλος του Huawei Cloud, Peter Zhou.












