Mô hình và nền tảng AI
OceanStor M900 Mang Bộ Nhớ Ngữ Cảnh Quy Mô PB Đến Huawei SuperPoDs

Huawei giới thiệu OceanStor M900 Context Memory Storage tại HUAWEI CONNECT 2026 ở Thượng Hải vào ngày 17 tháng 9, 2026, công bố một hệ thống lưu trữ được thiết kế cho việc suy luận AI trong các trung tâm dữ liệu quy mô siêu lớn. David Wang, Phó Chủ tịch Hội đồng Quản trị và Chủ tịch Luân chuyển tại Huawei, đã trình bày sản phẩm trong bài phát biểu chính của mình, và Huawei cho biết một cụm duy nhất cung cấp 64 PB dung lượng KV cache.
Theo Huawei, hệ thống cung cấp cho SuperPoDs một không gian bộ nhớ hoàn toàn chia sẻ với dung lượng quy mô PB và hiệu năng mức TB/s, được xây dựng trên mạng liên kết UnifiedBus của công ty. Bài phát biểu chính của Wang có tiêu đề “Advancing the Agentic World, Building a Solid Silicon Foundation,” và Huawei mô tả buổi ra mắt như một bước chuyển đổi trong hạ tầng AI từ mô hình tập trung vào tính toán sang sự hợp tác sâu hơn giữa tính toán, mạng và lưu trữ.
Giới Hạn Bộ Nhớ Trong Suy Luận AI Quy Mô Lớn
Trong thông cáo của mình, Huawei mô tả năm 2026 là năm mà AI đã chuyển từ các đột phá công nghệ sang triển khai quy mô lớn, với các ứng dụng tiến hóa từ chatbot thành các tác nhân có khả năng tự động hoàn thành các nhiệm vụ phức tạp. Công ty cho biết các tác nhân này đã được áp dụng rộng rãi trong các lĩnh vực bao gồm nghiên cứu khoa học, chăm sóc sức khỏe, tài chính và dịch vụ công, và họ mô tả sự chuyển đổi này là khởi đầu của thời đại AI tác nhân.
Huawei cho biết các mô hình lớn đang tăng lên tới quy mô 10 nghìn tỷ tham số, trong khi các mô hình chính đã hỗ trợ cửa sổ ngữ cảnh vượt quá một triệu token, làm cho suy luận đa vòng và các nhiệm vụ phức tạp trở thành tiêu chuẩn và thúc đẩy sự tăng trưởng liên tục của dữ liệu KV cache. Khi dữ liệu này tích lũy, công ty nói rằng bộ nhớ trên chip và DRAM đã bị đẩy vượt giới hạn cả về dung lượng lẫn hiệu quả chi phí. Một phần FAQ đính kèm thông cáo định nghĩa KV cache là việc lưu trữ dữ liệu Key và Value được tạo ra trong quá trình suy luận mô hình lớn để có thể tái sử dụng trong các lần suy luận tiếp theo, tránh tính toán dư thừa. Huawei mô tả sự đồng thuận trong ngành về việc xây dựng lưu trữ đa tầng phối hợp bộ nhớ trên chip, DRAM và SSD thành một không gian bộ nhớ hoàn toàn chia sẻ, và cho biết M900 được thiết kế để vượt qua các nút cổ chai về dung lượng bộ nhớ trong ngữ cảnh siêu dài và suy luận đa vòng. Công ty cũng mô tả SuperPoDs là lựa chọn tối ưu cho hạ tầng AI khi các mô hình mở rộng.
Ba Công Nghệ Đằng Sau M900
Về dung lượng, Huawei cho biết mạng liên kết UnifiedBus cho phép OceanStor M900 xây dựng một KV cache đa tầng toàn cầu quy mô PB với các kết nối một bước, tổng hợp và chia sẻ cache trên toàn cụm với lưu trữ phân tầng. Thiết kế này mở rộng KV cache của SuperPoD từ bộ nhớ trên chip và DRAM sang SSD, cho phép một cụm duy nhất cung cấp 64 PB dung lượng, theo công ty. Huawei cho biết dung lượng KV cache khả dụng trên mỗi NPU tăng từ gigabyte lên terabyte, cho phép lưu trữ, chia sẻ và tái sử dụng nhiều ngữ cảnh hơn, điều này theo họ làm tăng đáng kể tỷ lệ hit của KV cache.
Về hiệu năng, Huawei mô tả OceanStor M900 là kiến trúc đầu tiên trong ngành tích hợp CPU, đơn vị điều khiển mạng và đơn vị điều khiển NAND, cung cấp ngữ nghĩa KV gốc cho phép kết nối một bước từ các NPU của SuperPoD tới SSD. Công ty báo cáo rằng việc loại bỏ chuyển đổi giao thức và chuyển tiếp CPU giảm độ trễ truy cập từ mili giây xuống 60 micro giây, giảm 90%. Huawei cũng báo cáo băng thông truy cập tổng hợp 40 TB/s cho một cụm duy nhất, con số này họ mô tả là cao hơn 1,5 lần so với các giải pháp cùng ngành. Trong các kịch bản lập trình AI điển hình, công ty cho biết kiến trúc này gấp đôi thông lượng token của một cụm suy luận và giảm một nửa thời gian tới token đầu tiên.
Về chi phí, Huawei cho biết M900 sử dụng công nghệ lưu trữ thích ứng nhận thức KV đầu tiên trong ngành, dự đoán vòng đời KV cache dựa trên giá trị dữ liệu và phân phối dữ liệu qua các phương tiện lưu trữ tương ứng. Công ty báo cáo rằng công nghệ này hỗ trợ lên tới 24 lần ghi ổ đĩa mỗi ngày, kéo dài tuổi thọ SSD gấp 16 lần, và đảm bảo ổn định trong ba năm, giảm chi phí thay thế phương tiện và chi phí vận hành, bảo trì trong hạ tầng suy luận quy mô lớn.
Vị Trí Sản Phẩm và Chi Tiết Sự Kiện
Trong FAQ của mình, Huawei mô tả Context Memory Storage, được đại diện bởi M900, là một hạ tầng dữ liệu mới cho SuperPoDs trong các trung tâm dữ liệu quy mô siêu lớn, cung cấp bộ nhớ chia sẻ hoàn toàn quy mô PB và cho phép lưu trữ phân tầng cùng lịch trình hiệu quả cho KV cache trên bộ nhớ trên chip, DRAM và SSD. Công ty khẳng định rằng Context Memory Storage sẽ trở thành yếu tố thiết yếu để liên tục nâng cao dung lượng và hiệu quả truy cập của KV cache suy luận quy mô siêu lớn. Huawei cũng cho biết sẽ tiếp tục thúc đẩy sự đồng bộ phần cứng‑phần mềm và đổi mới ở cấp hệ thống để cung cấp hạ tầng AI mở, hiệu quả và bền vững cho quá trình chuyển đổi thông minh trên mọi ngành.
HUAWEI CONNECT 2026, với chủ đề “Advancing the Agentic World,” diễn ra từ ngày 17 đến 19 tháng 9, 2026, tại Trung tâm Triển lãm & Hội nghị Thế giới Shanghai và Trung tâm Triển lãm Shanghai, và thông cáo cho biết sự kiện sẽ xem xét AI qua các khía cạnh chiến lược, công nghệ và hệ sinh thái. Trang sự kiện chính thức liệt kê chương trình gồm ba bài phát biểu chính, 20 hội nghị thượng đỉnh, hơn 60 phiên họp và hơn 200 bài phát biểu mở, với các diễn giả chính đã lên lịch bao gồm CEO Linux Foundation Jim Zemlin, Chủ tịch iFLYTEK Liu Qingfeng, và CEO Huawei Cloud Peter Zhou.












