Hợp tác
Google DeepMind Trình Bày Cách 15 Năm Nghiên Cứu Trò Chơi Dẫn Đến EVE Online

Google DeepMind đã công bố một bản tường trình chi tiết về hành trình 15 năm nghiên cứu AI trong các trò chơi, kết thúc bằng quan hệ hợp tác nghiên cứu với Fenris Creations, studio độc lập đứng sau EVE Online, và đề ra chương trình nghiên cứu theo giai đoạn mà hai tổ chức dự định thực hiện trong vũ trụ EVE. Bài đăng ngày 21 tháng 8, 2026 kết nối các kết quả học tăng cường sớm nhất của phòng thí nghiệm với công việc hiện tại về các tác nhân đa năng và nêu ra các khả năng cụ thể mà môi trường EVE dự kiến sẽ kiểm tra.
Đánh giá lại bao quát chuỗi kết quả trò chơi đã xây dựng chương trình nghiên cứu của phòng thí nghiệm: Deep Q-Network đã học 49 trò Atari 2600 từ các pixel thô, được ghi lại trong một bài báo Nature năm 2015; chiến thắng năm 2016 của AlphaGo trước nhà vô địch thế giới Lee Sae Dol; AlphaGo Zero và AlphaZero, loại bỏ dữ liệu con người và tổng quát hoá trên cờ vua, shogi và Go; MuZero, chơi mà không biết luật; và AlphaStar, đạt cấp độ Grandmaster trong StarCraft II vào năm 2019. Những nền tảng này, bài đăng ghi chú, đã được đưa vào AlphaFold, hệ thống dự đoán cấu trúc protein được công nhận với Giải Nobel Hóa học năm 2024.
Từ Việc Thống Trị Trò Chơi Đến Việc Hoạt Động Bên Trong Chúng
Bài đăng mô tả một sự chuyển dịch trong nghiên cứu trò chơi của phòng thí nghiệm: rời xa các hệ thống chỉ thống trị một trò chơi duy nhất với điểm số rõ ràng, hướng tới các tác nhân có thể hoạt động trong bất kỳ thế giới trò chơi nào như con người. Phương tiện thực hiện điều đó là SIMA, Scalable Instructable Multiworld Agent, cho phép nhận thức những gì người chơi nhìn trên màn hình và hành động qua các điều khiển bàn phím, chuột thông thường mà không cần truy cập mã nguồn trò chơi.
SIMA 2, được giới thiệu vào tháng 11 năm 2025 với mô hình Gemini làm lõi, đã vượt qua danh mục hơn 600 kỹ năng tuân theo ngôn ngữ của phiên bản đầu tiên, tiến tới suy luận về mục tiêu, trò chuyện với người dùng và cải thiện qua việc chơi tự định hướng. Google DeepMind cho biết SIMA 2 thu hẹp một phần đáng kể khoảng cách so với hiệu suất hoàn thành nhiệm vụ của con người trên các môi trường đào tạo, bao gồm cả những trò chơi mà nó chưa từng được huấn luyện, chẳng hạn như ASKA và một triển khai nghiên cứu Minecraft. Các giới hạn do phòng thí nghiệm tự công bố: tác nhân vẫn gặp khó khăn với các nhiệm vụ có thời gian dài, hoạt động dựa trên bộ nhớ ngắn bị giới hạn bởi cửa sổ ngữ cảnh cần cho tương tác độ trễ thấp, và chỉ có sẵn như bản xem trước nghiên cứu hạn chế cho một nhóm nhỏ các học giả và nhà phát triển trò chơi.
Những Gì Đối Tác EVE Thêm Vào
Quan hệ đối tác với Fenris Creations, được công bố đầu năm nay khi studio đứng sau EVE Online trở nên độc lập, mang lại cho DeepMind quyền truy cập vào một thế giới bền vững đã hoạt động liên tục từ năm 2003. Vũ trụ đơn shard của EVE Online chứa hàng ngàn người chơi trong một nền kinh tế chung với các động lực cung‑cầu thực tế và cấu trúc chính trị được xây dựng hoàn toàn bởi người chơi. Fenris Creations, studio độc lập đứng sau Vũ trụ EVE, đã dành hơn hai thập kỷ để xây dựng một trong những thế giới bền vững nhất trong ngành game.
Bài đăng xác định bốn khả năng mà môi trường này dự kiến sẽ kiểm tra: học liên tục mà không quên, trí nhớ mở rộng vượt qua các cửa sổ ngữ cảnh hiện tại, lập kế hoạch dài hạn trong vòng vài tuần hoặc tháng, và động lực đa‑tác nhân phức tạp bao gồm hợp tác, cạnh tranh, đàm phán và kinh tế.
“Cùng với Google DeepMind, chúng tôi đang tiến vào một vùng đất chưa được khám phá, nơi AI phải học, thích nghi và ghi nhớ trên các thang thời gian mà không môi trường trò chơi nào khác yêu cầu,” Hilmar Pétursson, CEO của Fenris Creations, nói trong bài đăng.
Quan hệ đối tác mở rộng qua ba môi trường riêng biệt. EVE Online cung cấp vũ trụ bền vững quy mô lớn; EVE Vanguard bổ sung quyết định chiến thuật nhanh chóng góc nhìn thứ nhất; EVE Frontier, với các Smart Assemblies có thể lập trình, tạo ra một thế giới nơi các quy tắc tự chúng có thể thay đổi.
Chương trình nghiên cứu tuân theo một lộ trình theo giai đoạn: bắt đầu bằng một phiên bản offline của EVE Online tách biệt khỏi người chơi trực tiếp, tiến qua EVE Frontier để nghiên cứu cách con người và tác nhân cùng tồn tại trong một thế giới bền vững, và chỉ đưa vào các trò chơi trực tiếp khi các khả năng đã trưởng thành. Một hệ thống từ sự hợp tác này đã xuất hiện trước người chơi: Aura Guidance, ra mắt dưới dạng nguyên mẫu vào ngày 17 tháng 2, 2026, sử dụng Gemini để trả lời các câu hỏi của người mới dựa trên ngân hàng câu hỏi Rookie Help đã được kiểm duyệt, và đang chạy dưới dạng thử nghiệm A/B kiểm soát để đo lường liệu nó có cải thiện tỷ lệ giữ chân người mới hay không.
Quỹ thời gian dài hơn, như bài đăng mô tả, kéo dài từ các pixel thô của Atari đến một vũ trụ bền vững đã tồn tại 23 năm: mỗi môi trường được chọn vì nó buộc phòng thí nghiệm phải phát triển khả năng tiếp theo mà họ tin một tác nhân tổng quát cần có. Vũ trụ EVE là thử nghiệm hiện tại của cách tiếp cận này, và môi trường sandbox offline là nơi công việc hiện đang bắt đầu.












