Partnerstwa

Google DeepMind rozszerza 15‑letnie badania nad sztuczną inteligencją w grach na EVE Online

mm
Dodaj Unite.AI do preferowanych źródeł w Google

Google DeepMind opublikował szczegółowy opis swojego 15‑letniego łuku badań nad AI w grach, kulminującego w partnerstwie badawczym z Fenris Creations, niezależnym studiem stojącym za EVE Online, oraz przedstawiającego etapowy program badawczy, który dwie organizacje planują prowadzić wewnątrz wszechświata EVE. Post z 21 sierpnia 2026 łączy najwcześniejsze wyniki laboratorium w dziedzinie uczenia ze wzmocnieniem z obecną pracą nad agentami ogólnymi i wymienia konkretne zdolności, które środowisko EVE ma przetestować.

Retrospektywa obejmuje ciąg osiągnięć w grach, na których powstał program badawczy laboratorium: Deep Q-Network, który nauczył się 49 gier Atari 2600 bezpośrednio z pikseli, opisany w 2015 Nature paper; zwycięstwo AlphaGo nad mistrzem świata Lee Sedolem w 2016 roku; AlphaGo Zero i AlphaZero, które wyeliminowały dane pochodzące od ludzi i uogólniły podejście na szachy, shogi oraz Go; MuZero, który grał bez znajomości zasad; oraz AlphaStar, który w 2019 roku osiągnął poziom Grandmaster w StarCraft II. Jak zauważa wpis, te same podstawy wykorzystano w AlphaFold — systemie przewidywania struktur białek, którego znaczenie doceniono Nagrodą Nobla z chemii w 2024 roku.

Od opanowywania gier do działania w ich wnętrzu

Post opisuje zmianę w badaniach gier prowadzonych w laboratorium: odejście od systemów, które opanowują jedną grę z wyraźnym wynikiem, w kierunku agentów zdolnych działać w dowolnym świecie gry tak, jak człowiek. Nośnikiem tej zmiany jest SIMA, Scalable Instructable Multiworld Agent, który postrzega to, co gracz widzi na ekranie, i działa przy użyciu zwykłych klawiatury i myszy, nie mając dostępu do kodu gry.

SIMA 2, wprowadzona w listopadzie 2025 z modelem Gemini jako rdzeniem, wykracza poza repertuar pierwszej wersji, obejmujący ponad 600 umiejętności podążania za językiem, w kierunku rozumowania o celach, konwersacji z użytkownikami i doskonalenia się poprzez samodzielną rozgrywkę. Google DeepMind informuje, że SIMA 2 zamyka znaczną część luki w wydajności ludzkiego wykonywania zadań w swoich środowiskach treningowych, w tym w grach, w których nigdy nie była szkolona, takich jak ASKA i implementacja badawcza Minecraft. Własne ograniczenia laboratorium: agent wciąż ma trudności z bardzo długoterminowymi zadaniami, działa na krótkiej pamięci ograniczonej oknem kontekstu potrzebnym do interakcji o niskiej latencji i jest dostępny jedynie jako ograniczony podgląd badawczy dla niewielkiej grupy akademików i twórców gier.

Co dodaje partnerstwo z EVE

Partnerstwo z Fenris Creations, ogłoszone na początku tego roku, kiedy studio stojące za EVE Online stało się niezależne, daje DeepMind dostęp do trwałego świata, który działa nieprzerwanie od 2003 roku. Jedno‑shardowy wszechświat EVE Online skupia tysiące graczy w jednej wspólnej gospodarce z rzeczywistą dynamiką podaży i popytu oraz strukturami politycznymi budowanymi w całości przez graczy. Fenris Creations, niezależne studio stojące za wszechświatem EVE, spędziło ponad dwie dekady, budując jeden z najbardziej trwałych światów w grach.

Post identyfikuje cztery zdolności, które środowisko ma przetestować: ciągłe uczenie się bez zapominania, pamięć wykraczająca poza bieżące okna kontekstu, długoterminowe planowanie trwające tygodnie lub miesiące oraz złożoną dynamikę wielo‑agentową obejmującą współpracę, rywalizację, negocjacje i ekonomię.

„Wraz z Google DeepMind wkraczamy w nieznane terytorium, w którym AI musi uczyć się, adaptować i pamiętać w skalach czasowych, jakich żadne inne środowisko gry nie wymaga,” powiedział w poście Hilmar Pétursson, dyrektor generalny Fenris Creations.

Partnerstwo obejmuje trzy odrębne środowiska. EVE Online oferuje rozległy, trwały wszechświat; EVE Vanguard dodaje perspektywę pierwszej osoby i szybkie decyzje taktyczne; EVE Frontier, z programowalnymi Smart Assemblies, prezentuje świat, w którym same reguły mogą się zmieniać.

Program badawczy podąża za etapowym planem: zaczyna się w trybie offline EVE Online odseparowanym od żywych graczy, przechodzi przez EVE Frontier, aby badać współistnienie ludzi i agentów w trwałym świecie, i dociera do gier na żywo dopiero, gdy zdolności są dojrzałe. Jeden z systemów wynikających ze współpracy jest już dostępny graczom: Aura Guidance, uruchomiony w prototypie 17 lutego 2026, wykorzystuje Gemini do odpowiadania na pytania nowych graczy pochodzące z zweryfikowanej bazy rzeczywistych zapytań Rookie Help i jest testowany w kontrolowanym eksperymencie A/B, aby zmierzyć, czy poprawia retencję nowych graczy.

Dłuższy łuk, jak opisuje post, prowadzi od surowych pikseli Atari do 23‑letniego trwałego wszechświata: każde środowisko wybrano, ponieważ wymusza kolejną zdolność, którą laboratorium uważa za niezbędną dla ogólnego agenta. Wszechświat EVE jest obecnie testem tego podejścia, a offline sandbox to miejsce, w którym praca teraz się rozpoczyna.

Jonas Reeve jest analitykiem generowanym przez SI w Unite.AI, koncentrującym się na kognitywnej SI, sztucznej ogólnej inteligencji (AGI) oraz teoretycznych podstawach inteligencji maszynowej. Jego praca bada, jak uczenie się, rozumowanie, pamięć i abstrakcja wyłaniają się zarówno w systemach biologicznych, jak i sztucznych, tworząc powiązania między współczesnymi architekturami SI a długoletnimi pytaniami w naukach kognitywnych i filozofii umysłu.

Z koncepcyjnym i refleksyjnym podejściem Jonas bada ramy takie jak modele rozumowania, systemy agentowe, emergentna kognicja i teoria zgodności, dążąc do wyjaśnienia, co tak naprawdę oznacza postęp w kierunku AGI — a czego nie. Zamiast gonić za terminami czy hype’em, podkreśla pierwsze zasady, rygor konceptualny oraz ograniczenia obecnych modeli.

Artykuły autorstwa Jonasa Reeve są generowane przez SI i recenzowane przez zespół redakcyjny Unite.AI, aby zapewnić dokładność, przejrzystość i odpowiedzialną dyskusję zaawansowanych koncepcji SI.