Mô hình và nền tảng AI
Phân tích các thông báo của Nvidia tại Computex Taipei

Trong một bài phát biểu đầy ấn tượng tại hội nghị Computex Taipei gần đây, CEO của NVIDIA (NVDA ), Jensen Huang, đã chính thức giới thiệu nền tảng Grace Hopper. Sự kết hợp này giữa CPU Nvidia Grace tiết kiệm năng lượng và GPU Nvidia H100 Tensor Core hiệu suất cao đánh dấu một chân trời mới trong chức năng AI cấp doanh nghiệp.
Khởi động Grace Hopper và DGX GH200
Mô-đun AI toàn diện này không phải là thông báo đáng chú ý duy nhất được Huang thực hiện. DGX GH200, một siêu máy tính AI mạnh mẽ, cũng đã thu hút sự chú ý. Với khả năng bộ nhớ phi thường, siêu máy tính này có thể chứa tới 256 Nvidia Grace Hopper Superchips trong một GPU có kích thước như một trung tâm dữ liệu thông thường.
DGX GH200 thực sự là một cỗ máy mạnh mẽ, cung cấp hiệu suất exaflop và có 144 terabyte bộ nhớ chia sẻ. Điều này vượt trội so với các mẫu trước đó với hệ số 500, mở cửa cho các nhà phát triển xây dựng các mô hình ngôn ngữ phức tạp cho các rô-bốt trò chuyện AI thế hệ tiếp theo, tạo ra các thuật toán tiên tiến cho các hệ thống đề xuất và xây dựng các mạng nơ-ron đồ thị tinh vi, quan trọng cho việc phát hiện gian lận và các nhiệm vụ phân tích dữ liệu. Như Huang đã phác thảo, các nhà lãnh đạo công nghệ như Google Cloud, Meta và Microsoft (MSFT ) đã bắt đầu tận dụng khả năng của DGX GH200 để xử lý các công việc AI tạo sinh của họ.
“Siêu máy tính AI DGX GH200 tích hợp các công nghệ tính toán và mạng gia tốc tiên tiến nhất của Nvidia, đẩy ranh giới của AI,” Huang nhấn mạnh.
Nvidia Avatar Cloud Engine (ACE) cho Trò chơi
Trong một thông báo quan trọng đã đưa các nhà phát triển trò chơi vào tâm điểm, Huang đã tiết lộ Nvidia Avatar Cloud Engine (ACE) cho Trò chơi. Dịch vụ này cho phép các nhà phát triển tạo và triển khai các mô hình AI tùy chỉnh cho giọng nói, hội thoại và hoạt hình. Công cụ ACE trao quyền cho các nhân vật không thể chơi được khả năng tham gia vào hội thoại, từ đó trả lời các câu hỏi với những tính cách giống như thật liên tục phát triển.
Bộ công cụ mạnh mẽ này bao gồm các mô hình nền tảng AI quan trọng, chẳng hạn như Nvidia Riva để phát hiện và chuyển văn bản giọng nói, Nvidia NeMo để tạo ra các phản hồi tùy chỉnh và Nvidia Omniverse Audio2Face để tạo hoạt hình cho các phản hồi này.
Nvidia và Microsoft’s Nỗ lực Hợp tác
Bài phát biểu cũng nhấn mạnh sự hợp tác mới của Nvidia với Microsoft để thúc đẩy sự ra đời của AI tạo sinh trên máy tính Windows. Sự hợp tác này sẽ phát triển các công cụ, khuôn khổ và trình điều khiển cải tiến để đơn giản hóa quá trình phát triển và triển khai AI trên máy tính.
Nỗ lực hợp tác này sẽ tăng cường và mở rộng cơ sở cài đặt hơn 100 triệu máy tính được trang bị GPU RTX có Tensor Cores. Sự cải tiến này hứa hẹn sẽ tăng cường hiệu suất của hơn 400 ứng dụng và trò chơi AI được tăng tốc trên Windows.
AI Tạo sinh và Quảng cáo Kỹ thuật số:
Theo Huang, tiềm năng của AI tạo sinh cũng mở rộng đến lĩnh vực quảng cáo kỹ thuật số. Nvidia đã hợp tác với WPP, một tổ chức dịch vụ tiếp thị, để phát triển một công cụ nội dung sáng tạo trên nền tảng Omniverse Cloud.
Công cụ này kết nối các đội sáng tạo với các công cụ thiết kế 3D như Adobe Substance 3D để tạo ra các bản sao kỹ thuật số của sản phẩm khách hàng trong Nvidia Omniverse. Thông qua việc sử dụng các công cụ AI tạo sinh, được cung cấp bởi Nvidia Picasso và đào tạo trên dữ liệu có nguồn gốc có trách nhiệm, các đội này hiện có thể nhanh chóng tạo ra các bộ phim ảo. Khả năng cách mạng này cho phép khách hàng của WPP sản xuất một loạt quảng cáo, video và trải nghiệm 3D, được tùy chỉnh cho các thị trường toàn cầu và có thể truy cập trên bất kỳ thiết bị web nào.
Cách mạng Kỹ thuật số trong Sản xuất
Một trong những trọng tâm chính của Nvidia đã là sản xuất, một ngành công nghiệp khổng lồ trị giá 46 nghìn tỷ đô la bao gồm khoảng 10 triệu nhà máy. Huang đã展示 cách các nhà sản xuất điện tử như Foxconn Industrial Internet, Innodisk, Pegatron, Quanta và Wistron đang tận dụng các công nghệ của Nvidia. Bằng cách áp dụng các quy trình kỹ thuật số, các công ty này đang tiến gần hơn đến giấc mơ của các nhà máy thông minh kỹ thuật số hoàn toàn.
“Các ngành công nghiệp lớn nhất trên thế giới tạo ra các sản phẩm vật chất. Bằng cách xây dựng chúng trước tiên ở dạng kỹ thuật số, chúng ta có thể tiết kiệm hàng tỷ đô la,” Huang tuyên bố.
Sự tích hợp của Omniverse và các API AI tạo sinh đã cho phép các công ty này xây dựng các cầu nối giữa các công cụ thiết kế và sản xuất, tạo ra các bản sao kỹ thuật số của các nhà máy của họ – các bản sao kỹ thuật số. Hơn nữa, họ đang sử dụng Nvidia Isaac Sim để mô phỏng và thử nghiệm rô-bốt và Nvidia Metropolis – một khuôn khổ AI tầm nhìn – để kiểm tra quang học tự động. Sản phẩm mới nhất của Nvidia, Nvidia Metropolis cho Nhà máy, mở ra con đường cho việc tạo ra các hệ thống kiểm soát chất lượng tùy chỉnh, mang lại lợi thế cạnh tranh cho các nhà sản xuất và cho phép họ phát triển các ứng dụng AI tiên tiến.
Xây dựng Nvidia Helios và Giới thiệu Nvidia MG
Ngoài ra, Nvidia đã tiết lộ việc xây dựng siêu máy tính AI tuyệt đẹp, Nvidia Helios. Dự kiến sẽ hoạt động vào cuối năm nay, Helios sẽ tận dụng bốn hệ thống DGX GH200 liên kết với mạng Nvidia Quantum-2 InfiniBand, cung cấp băng thông lên đến 400Gb/s. Điều này sẽ tăng đáng kể lưu lượng dữ liệu cho việc đào tạo các mô hình AI quy mô lớn.
Bổ sung cho những phát triển đột phá này, Nvidia đã giới thiệu Nvidia MGX, một kiến trúc tham chiếu mô-đun cho phép các nhà sản xuất hệ thống tạo ra nhiều cấu hình máy chủ được tùy chỉnh cho các ứng dụng AI, HPC và Nvidia Omniverse một cách hiệu quả và tiết kiệm chi phí.
Với kiến trúc MGX, các nhà sản xuất có thể phát triển các CPU và máy chủ tăng tốc tiêu chuẩn hóa bằng cách sử dụng các thành phần mô-đun. Các cấu hình này hỗ trợ nhiều loại GPU, CPU, đơn vị xử lý dữ liệu (DPUs) và bộ điều khiển mạng, bao gồm cả bộ xử lý x86 và Arm. Các cấu hình MGX có thể được đặt trong cả vỏ máy làm mát bằng không khí và làm mát bằng chất lỏng. Đứng đầu trong việc áp dụng các thiết kế MGX là QCT và Supermicro, với các công ty lớn khác như ASRock Rack, ASUS, GIGABYTE và Pegatron dự kiến sẽ theo sát.
Cách mạng hóa Cơ sở Hạ tầng 5G và Mạng Lưới Đám mây
Nhìn về phía trước, Huang đã công bố một loạt các quan hệ đối tác nhằm cách mạng hóa cơ sở hạ tầng 5G và mạng lưới đám mây. Một quan hệ đối tác đáng chú ý với một gã khổng lồ viễn thông Nhật Bản sẽ tận dụng Nvidia Grace Hopper và BlueField-3 DPUs trong các hệ thống mô-đun MGX để phát triển một mạng phân tán các trung tâm dữ liệu.
Bằng cách tích hợp các công tắc ethernet Nvidia Spectrum, các trung tâm dữ liệu sẽ cung cấp thời gian chính xác cần thiết bởi giao thức 5G, dẫn đến hiệu suất phổ tần số được cải thiện và tiêu thụ năng lượng thấp hơn. Nền tảng này có tiềm năng cho nhiều ứng dụng, bao gồm lái xe tự động, nhà máy AI, thực tế ảo và thực tế tăng cường, tầm nhìn máy tính và bản sao kỹ thuật số.
Ngoài ra, Huang đã tiết lộ Nvidia Spectrum-X, một nền tảng mạng được thiết kế để tăng cường hiệu suất và hiệu quả của các đám mây AI dựa trên ethernet. Bằng cách kết hợp các công tắc ethernet Spectrum-4 với BlueField-3 DPUs và phần mềm, Spectrum-X cung cấp mức tăng 1,7 lần về hiệu suất AI và hiệu quả năng lượng. Các nhà sản xuất hệ thống lớn như Dell Technologies (DELL ), Lenovo và Supermicro đã cung cấp Nvidia Spectrum-X, công tắc Spectrum-4 và BlueField-3 DPUs.
Thiết lập Trung tâm Siêu máy tính AI Tạo sinh
Nvidia cũng đang thực hiện những bước tiến lớn trong việc thiết lập các trung tâm siêu máy tính AI tạo sinh trên toàn thế giới. Đặc biệt, công ty đang xây dựng Israel-1, một siêu máy tính hiện đại, trong trung tâm dữ liệu của mình tại Israel. Siêu máy tính này nhằm mục đích thúc đẩy các nỗ lực nghiên cứu và phát triển địa phương.
Và tại Đài Loan, hai siêu máy tính mới đang được phát triển: Taiwania 4 và Taipei-1. Những bổ sung này hứa hẹn sẽ tăng cường đáng kể các sáng kiến nghiên cứu và phát triển địa phương, củng cố cam kết của Nvidia trong việc thúc đẩy các biên giới của AI và siêu máy tính trên toàn cầu.












