Mô hình và nền tảng AI

Google Cloud Next 2025: Đánh cược vào Trí tuệ nhân tạo với Silicon, Phần mềm và Hệ sinh thái Mở cho Đại lý

mm
Thêm Unite.AI vào các nguồn ưu tiên của bạn trên Google

Las Vegas đang tổ chức Google Cloud Next 2025 (GOOGL ), một sự kiện diễn ra tại một thời điểm quan trọng cho ngành công nghệ. Cuộc đua vũ trang về trí tuệ nhân tạo giữa các gã khổng lồ đám mây – Amazon (AMZN ) Web Services (AWS), Microsoft Azure và Google Cloud – đang gia tăng nhanh chóng. Google, thường được coi là người cạnh tranh thứ ba mặc dù có khả năng công nghệ đáng gờm và nghiên cứu trí tuệ nhân tạo sâu sắc, đã chiếm lĩnh sân khấu Cloud Next để trình bày một chiến lược toàn diện và hung hãn nhằm vào thị trường doanh nghiệp trí tuệ nhân tạo.

Câu chuyện, được trình bày bởi CEO Google Cloud Thomas Kurian và được nhắc lại bởi CEO Google và Alphabet (GOOG ) Sundar Pichai, tập trung vào việc chuyển đổi biến đổi trí tuệ nhân tạo từ khả năng thành hiện thực. Google nhấn mạnh động lực của mình, với hơn 3.000 tiến bộ sản phẩm trong năm qua, tăng trưởng 20 lần trong việc sử dụng nền tảng Vertex AI kể từ sự kiện Cloud Next trước, hơn 4 triệu nhà phát triển đang xây dựng với gia đình mô hình Gemini của họ và trình diễn hơn 500 câu chuyện thành công của khách hàng trong hội nghị.

Tuy nhiên, Google Cloud Next 2025 không chỉ là một buổi giới thiệu các cập nhật nhỏ hoặc các số liệu ấn tượng. Nó cũng đã công bố một cuộc tấn công đa diện. Bằng cách ra mắt silicon tùy chỉnh mạnh mẽ, tối ưu hóa cho suy luận (Ironwood TPU), tinh chỉnh danh mục mô hình trí tuệ nhân tạo hàng đầu với trọng tâm vào tính thực tế (Gemini 2.5 Flash), mở rộng cơ sở hạ tầng mạng toàn cầu của mình cho các doanh nghiệp (Cloud WAN) và đặt cược chiến lược quan trọng vào một hệ sinh thái mở, tương tác cho các đại lý trí tuệ nhân tạo (giao thức Agent2Agent), Google đang hung hãn định vị mình để định nghĩa giai đoạn tiến hóa tiếp theo của trí tuệ nhân tạo doanh nghiệp – những gì công ty đang ngày càng gọi là “thời đại đại lý”.

Sắt, Gemini và Hiệu ứng Mạng

Trọng tâm của tham vọng trí tuệ nhân tạo của Google là đầu tư liên tục vào silicon tùy chỉnh. Ngôi sao của Cloud Next 2025 là Ironwood, thế hệ thứ bảy của Bộ xử lý Tensor (TPU) của Google. Điều quan trọng là Ironwood được trình bày như là TPU đầu tiên được thiết kế rõ ràng cho suy luận trí tuệ nhân tạo – quá trình sử dụng các mô hình đã được đào tạo để đưa ra dự đoán hoặc tạo ra đầu ra trong các ứng dụng thực tế.

Các tuyên bố về hiệu suất của Ironwood là đáng kể. Google đã cung cấp các cấu hình có thể mở rộng lên đến 9.216 chip làm mát bằng chất lỏng được kết nối trong một pod duy nhất. Cấu hình lớn nhất này được cho là cung cấp 42,5 exaflops sức tính toán. Google khẳng định điều này đại diện cho hơn 24 lần sức tính toán trên mỗi pod so với El Capitan, hiện được xếp hạng là siêu máy tính mạnh nhất thế giới.

Mặc dù ấn tượng, điều quan trọng cần lưu ý là các so sánh như vậy thường liên quan đến các mức độ chính xác số khác nhau, khiến cho sự tương đương trực tiếp trở nên phức tạp. Tuy nhiên, Google định vị Ironwood như một cải tiến hơn mười lần so với thế hệ TPU hiệu suất cao trước đó.

Ngoài sức tính toán thô, Ironwood còn có những tiến bộ đáng kể về bộ nhớ và khả năng kết nối so với người tiền nhiệm của nó, Trillium (TPU v6).

Có thể quan trọng không kém là sự nhấn mạnh vào hiệu suất năng lượng. Google tuyên bố Ironwood cung cấp gấp đôi hiệu suất trên mỗi watt so với Trillium và gần 30 lần hiệu suất năng lượng hơn so với TPU đám mây đầu tiên của họ vào năm 2018. Điều này trực tiếp giải quyết ràng buộc năng lượng ngày càng tăng trong việc mở rộng trung tâm dữ liệu cho trí tuệ nhân tạo.

So sánh Thế hệ TPU của Google: Ironwood (v7) vs. Trillium (v6)

Tính năng Trillium (TPU v6) Ironwood (TPU v7) Yếu tố Cải thiện
Trọng tâm Chính Đào tạo & Suy luận Suy luận Chuyên môn hóa
Sức tính toán đỉnh/Chip Không thể so sánh trực tiếp (khác thế hệ) 4.614 TFLOPs (FP8 có thể)
Dung lượng HBM/Chip 32 GB (ước tính dựa trên yêu cầu 6x) 192 GB 6x
Băng thông HBM/Chip ~1,6 Tbps (ước tính dựa trên 4,5x) 7,2 Tbps 4,5x
Băng thông ICI (hai chiều) ~0,8 Tbps (ước tính dựa trên 1,5x) 1,2 Tbps 1,5x
Hiệu suất/Watt so với Thế hệ trước Cơ sở so sánh 2x so với Trillium 2x
Hiệu suất/Watt so với TPU v1 (2018) ~15x (ước tính) Gần 30x ~2x so với Trillium


Lưu ý: Một số số liệu Trillium được ước tính dựa trên các yếu tố cải thiện được tuyên bố bởi Google cho Ironwood. So sánh sức tính toán đỉnh là phức tạp do sự khác biệt về thế hệ và có thể có sự khác biệt về độ chính xác.

Ironwood tạo thành một phần quan trọng của khái niệm “Siêu máy tính Trí tuệ nhân tạo” của Google – một kiến trúc tích hợp phần cứng tối ưu (bao gồm TPU và GPU như Nvidia’s Blackwell và sắp tới Vera Rubin), phần mềm (như thời gian chạy phân tán ML Pathways), lưu trữ (Hyperdisk Exapools, Managed Lustre) và mạng để giải quyết các công việc trí tuệ nhân tạo đòi hỏi.

Về mặt mô hình, Google đã giới thiệu Gemini 2.5 Flash, một phản đề chiến lược cho Gemini 2.5 Pro. Trong khi Pro nhắm đến chất lượng tối đa cho lý luận phức tạp, Flash được tối ưu hóa rõ ràng cho độ trễ thấp và hiệu quả chi phí, khiến nó phù hợp cho các ứng dụng thời gian thực có khối lượng lớn như tương tác dịch vụ khách hàng hoặc tóm tắt nhanh.

Gemini 2.5 Flash có một “ngân sách suy nghĩ” động, điều chỉnh quá trình dựa trên độ phức tạp của truy vấn, cho phép người dùng điều chỉnh sự cân bằng giữa tốc độ, chi phí và độ chính xác. Sự tập trung đồng thời vào một con chip suy luận hiệu suất cao (Ironwood) và một mô hình tối ưu hóa chi phí/độ trễ (Gemini Flash) nhấn mạnh nỗ lực của Google trong việc hoạt động hóa trí tuệ nhân tạo, nhận ra rằng chi phí và hiệu quả của việc chạy mô hình trong sản xuất đang trở thành những mối quan tâm hàng đầu của các doanh nghiệp.

Bổ sung cho các cập nhật silicon và mô hình là việc ra mắt Cloud WAN. Google đang hiệu quả hóa mạng lưới toàn cầu khổng lồ của mình – bao gồm hơn hai triệu dặm sợi quang, kết nối 42 khu vực qua hơn 200 điểm hiện diện – và làm cho nó trực tiếp có sẵn cho khách hàng doanh nghiệp.

Google tuyên bố dịch vụ này có thể cung cấp hiệu suất nhanh hơn 40% so với internet công cộng và giảm tổng chi phí sở hữu xuống 40% so với mạng WAN tự quản lý, được hỗ trợ bởi SLA độ tin cậy 99,99%. Chủ yếu nhắm vào kết nối hiệu suất cao giữa các trung tâm dữ liệu và kết nối môi trường chi nhánh/trường, Cloud WAN tận dụng cơ sở hạ tầng hiện có của Google, bao gồm Trung tâm Kết nối Mạng.

Mặc dù Google đã đề cập đến Nestlé và Citadel Securities là những người dùng sớm, nhưng động thái này cơ bản đã biến một tài sản cơ sở hạ tầng cốt lõi thành một yếu tố khác biệt hóa cạnh tranh và có thể là một dòng doanh thu, thách thức trực tiếp cả các nhà cung cấp dịch vụ viễn thông truyền thống và các dịch vụ mạng của các nền tảng đám mây đối thủ như AWS Cloud WAN và Azure Virtual WAN.

(Nguồn: Google DeepMind)

Cuộc tấn công Đại lý: Xây dựng Cầu với ADK và A2A

Ngoài cơ sở hạ tầng và mô hình cốt lõi, Google Cloud Next 2025 đã đặt một sự nhấn mạnh phi thường vào các đại lý trí tuệ nhân tạo và các công cụ để xây dựng và kết nối chúng. Tầm nhìn được trình bày mở rộng xa hơn các hệ thống đơn giản như chatbot, tưởng tượng các hệ thống tinh vi có khả năng suy luận tự chủ, lập kế hoạch và thực hiện các nhiệm vụ phức tạp, nhiều bước. Sự tập trung rõ ràng đang chuyển hướng tới việc cho phép các hệ thống đa đại lý, nơi các đại lý chuyên dụng cộng tác để đạt được các mục tiêu rộng lớn hơn.

Để thúc đẩy tầm nhìn này, Google đã giới thiệu Bộ công cụ Phát triển Đại lý (ADK). ADK là một khuôn khổ mã nguồn mở, ban đầu có sẵn trong Python, được thiết kế để đơn giản hóa việc tạo ra các đại lý cá nhân và các hệ thống đa đại lý phức tạp. Google tuyên bố rằng các nhà phát triển có thể xây dựng một đại lý chức năng với ít hơn 100 dòng mã.

Các tính năng chính bao gồm cách tiếp cận mã đầu tiên cho kiểm soát chính xác, hỗ trợ bản địa cho kiến trúc đa đại lý, tích hợp công cụ linh hoạt (bao gồm hỗ trợ cho Giao thức Context Mô hình, hoặc MCP), khả năng đánh giá tích hợp, và các tùy chọn triển khai từ các thùng chứa cục bộ đến Máy Vertex AI được quản lý. ADK cũng hỗ trợ duy nhất luồng âm thanh và video hai chiều cho các tương tác tự nhiên, giống con người hơn. Một “Vườn Đại lý” đi kèm cung cấp các mẫu sẵn sàng sử dụng và hơn 100 bộ kết nối đã xây dựng để bắt đầu phát triển.

Trung tâm thực sự của chiến lược đại lý của Google, tuy nhiên, là Giao thức Đại lý sang Đại lý (A2A). A2A là một tiêu chuẩn mở mới, được thiết kế rõ ràng cho tính tương tác của đại lý. Mục tiêu cơ bản của nó là cho phép các đại lý trí tuệ nhân tạo, bất kể khuôn khổ chúng được xây dựng (ADK, LangGraph, CrewAI, v.v.) hoặc nhà cung cấp đã tạo ra chúng, để giao tiếp an toàn, trao đổi thông tin và phối hợp hành động. Điều này trực tiếp giải quyết thách thức lớn của các hệ thống trí tuệ nhân tạo bị cô lập trong các doanh nghiệp, nơi các đại lý được xây dựng cho các nhiệm vụ hoặc bộ phận khác nhau thường không thể tương tác.

Sự thúc đẩy này cho giao thức A2A mở đại diện cho một canh bạc chiến lược quan trọng. Thay vì xây dựng một hệ sinh thái đại lý độc quyền, đóng, Google đang cố gắng thiết lập tiêu chuẩn de facto cho giao tiếp đại lý. Cách tiếp cận này có thể hy sinh sự khóa chặt ngắn hạn để đổi lấy triển vọng lãnh đạo hệ sinh thái lâu dài và, quan trọng là, giảm ma sát cản trở việc áp dụng các hệ thống đa đại lý phức tạp trong doanh nghiệp.

Bằng cách ủng hộ sự mở cửa, Google nhằm mục đích tăng tốc toàn bộ thị trường đại lý, định vị nền tảng đám mây và công cụ của mình là trung tâm cho việc thúc đẩy.

Cách A2A hoạt động (Nguồn: Google)

Điều chỉnh lại Cuộc đua Đám mây: Đòn bẩy Cạnh tranh của Google

Những thông báo này được đưa ra hoàn toàn trong bối cảnh của các cuộc chiến đám mây đang diễn ra. Google Cloud, mặc dù đã chứng minh sự tăng trưởng ấn tượng thường được thúc đẩy bởi việc áp dụng trí tuệ nhân tạo, vẫn giữ vị trí thứ ba về thị phần, sau AWS và Microsoft Azure. Cloud Next 2025 đã trình diễn chiến lược của Google để điều chỉnh lại cuộc đua này bằng cách dựa nặng vào các điểm mạnh độc đáo của mình và giải quyết các điểm yếu được nhận thức.

Các điểm khác biệt chính của Google đã được trình bày đầy đủ. Đầu tư lâu dài vào silicon tùy chỉnh, kết thúc với TPU Ironwood tập trung vào suy luận, cung cấp một câu chuyện phần cứng khác biệt so với các chip Trainium/Inferentia của AWS và gia tốc Maia của Azure. Google liên tục nhấn mạnh sự lãnh đạo về hiệu suất trên mỗi watt, một yếu tố có thể quan trọng khi nhu cầu năng lượng của trí tuệ nhân tạo tăng vọt. Việc ra mắt Cloud WAN đã biến một tài sản cơ sở hạ tầng cốt lõi thành một lợi thế cạnh tranh và có thể là một dòng doanh thu, thách thức trực tiếp cả các nhà cung cấp dịch vụ viễn thông truyền thống và các dịch vụ mạng của các nền tảng đám mây đối thủ.

Hơn nữa, Google tiếp tục tận dụng di sản trí tuệ nhân tạo và học máy của mình, bắt nguồn từ nghiên cứu của DeepMind và được thể hiện trong nền tảng Vertex AI toàn diện, phù hợp với nhận thức thị trường của mình là một nhà lãnh đạo trong trí tuệ nhân tạo và phân tích dữ liệu.

Đồng thời, Google đã tín hiệu hóa nỗ lực để giải quyết các lo ngại của doanh nghiệp. Việc mua lại công ty bảo mật đám mây Wiz với giá 32 tỷ đô la, được công bố ngay trước Next, là một tuyên bố rõ ràng về ý định tăng cường tư thế bảo mật và cải thiện trải nghiệm của các dịch vụ bảo mật – những lĩnh vực quan trọng cho sự tin tưởng của doanh nghiệp.

Tiếp tục nhấn mạnh vào các giải pháp ngành, sự sẵn sàng của doanh nghiệp và các quan hệ đối tác chiến lược nhằm mục đích thay đổi nhận thức thị trường từ một nhà cung cấp công nghệ thuần túy thành một đối tác doanh nghiệp đáng tin cậy.

Tổng hợp lại, chiến lược của Google dường như tập trung ít hơn vào việc匹配 AWS và Azure dịch vụ cho dịch vụ trên toàn bảng, và nhiều hơn vào việc tận dụng các tài sản độc đáo của mình – nghiên cứu trí tuệ nhân tạo, phần cứng tùy chỉnh, mạng lưới toàn cầu và sự ưa chuộng mã nguồn mở – để thiết lập sự lãnh đạo trong những gì họ coi là làn sóng quan trọng tiếp theo của tính toán đám mây: Trí tuệ nhân tạo quy mô lớn, đặc biệt là suy luận hiệu quả và các hệ thống đại lý tinh vi.

Con đường phía trước cho Trí tuệ nhân tạo của Google

Google Cloud Next 2025 đã trình bày một câu chuyện đầy tham vọng và sự nhất quán chiến lược. Google đang đánh cược vào trí tuệ nhân tạo, huy động tài nguyên của mình trên silicon tùy chỉnh tối ưu hóa cho thời đại suy luận (Ironwood), một danh mục mô hình trí tuệ nhân tạo cân bằng và thực tế (Gemini 2.5 Pro và Flash), cơ sở hạ tầng mạng toàn cầu độc đáo (Cloud WAN) và một cách tiếp cận mở táo bạo đối với thế giới đang phát triển của các đại lý trí tuệ nhân tạo (ADK và A2A).

Cuối cùng, sự kiện đã trình diễn một công ty đang hành động hung hãn để chuyển đổi khả năng công nghệ sâu sắc của mình thành một dịch vụ doanh nghiệp toàn diện và khác biệt cho thời đại trí tuệ nhân tạo. Chiến lược tích hợp – phần cứng, phần mềm, mạng và tiêu chuẩn mở – là vững chắc. Tuy nhiên, con đường phía trước đòi hỏi nhiều hơn là chỉ đổi mới.

Thử thách quan trọng nhất của Google có thể nằm ít hơn trong công nghệ và nhiều hơn trong việc vượt qua sự bất động của việc áp dụng doanh nghiệp và xây dựng niềm tin lâu dài. Chuyển đổi những thông báo đầy tham vọng này thành lợi ích thị phần bền vững trước những đối thủ cạnh tranh sâu sắc đòi hỏi phải thực hiện một cách hoàn hảo, chiến lược tiếp cận thị trường rõ ràng và khả năng thuyết phục liên tục các tổ chức lớn rằng Google Cloud là nền tảng không thể thiếu cho tương lai được thúc đẩy bởi trí tuệ nhân tạo của họ. Tương lai đại lý mà Google tưởng tượng là hấp dẫn, nhưng việc thực hiện nó phụ thuộc vào việc điều hướng những động lực thị trường phức tạp này lâu sau khi ánh đèn sân khấu Las Vegas đã mờ dần.

Alex McFarland là một nhà báo và nhà văn về trí tuệ nhân tạo, khám phá những phát triển mới nhất trong lĩnh vực trí tuệ nhân tạo. Ông đã hợp tác với nhiều công ty khởi nghiệp và xuất bản về trí tuệ nhân tạo trên toàn thế giới.