Партнерства

Google DeepMind розширює 15‑річні дослідження ігрового ШІ у EVE Online

mm
Додайте Unite.AI до бажаних джерел у Google

Google DeepMind опублікувала докладний опис свого 15‑річного шляху досліджень ШІ в іграх, який завершився дослідницьким партнерством з Fenris Creations, незалежною студією, що стоїть за EVE Online, і викладає поетапну програму досліджень, яку обидві організації планують реалізувати всередині всесвіту EVE. Пост від 21 серпня 2026 р. пов’язує найперші результати лабораторії у підкріплювальному навчанні з її поточною роботою над генералістичними агентами та називає конкретні можливості, які, на її думку, має перевіряти середовище EVE.

У ретроспективі розглядається ланка ігрових результатів, що сформували дослідницьку програму лабораторії: Deep Q‑Network, який навчився 49 ігор Atari 2600 з необроблених пікселів, задокументовано у статті Nature 2015 р.; перемога AlphaGo у 2016 р. над чемпіоном світу Лі Седолом; AlphaGo Zero і AlphaZero, які відмовилися від даних людей і узагальнили навички у шахах, сёґі та ґо; MuZero, що грав без знання правил; і AlphaStar, який досяг рівня гросмейстер у StarCraft II у 2019 р. Самі ж фундаментальні підходи, зазначає пост, були перенесені в AlphaFold — систему визначення структури білків, визнану лауреатом Нобелівської премії з хімії 2024 р.

Від майстерності в іграх до роботи всередині них

У пості описується зміна у дослідженнях ігор лабораторії: від систем, які опановують одну гру з чітким підрахунком балів, до агентів, здатних функціонувати в будь‑якому ігровому світі так, як це робить людина. Засобом для цього є SIMA — масштабований інструктивний багатосвітовий агент, який сприймає те, що гравець бачить на екрані, і діє через звичайні клавіатуру та мишу, не маючи доступу до коду гри.

SIMA 2, представлений у листопаді 2025 р. з моделлю Gemini у ролі ядра, вийшов за межі репертуару першої версії, що включав понад 600 навичок слідування за мовою, і перейшов до міркувань про цілі, спілкування з користувачами та вдосконалення через самостійну гру. Google DeepMind повідомляє, що SIMA 2 зменшує значну частину розриву у виконанні завдань порівняно з людьми у різних навчальних середовищах, включаючи ігри, на яких вона ніколи не навчалася, такі як ASKA та дослідницька реалізація Minecraft. За словами лабораторії, існують обмеження: агент все ще має труднощі з дуже довготривалими завданнями, працює з короткочасною пам’яттю, обмеженою контекстним вікном, необхідним для низьколатентної взаємодії, і доступний лише як обмежений дослідницький прев’ю для невеликої групи академіків і розробників ігор.

Що додає партнерство з EVE

Партнерство з Fenris Creations, оголошене на початку цього року, коли студія, що стоїть за EVE Online, стала незалежною, надає DeepMind доступ до постійного світу, який працює безперервно з 2003 р. Єдиний‑шардовий всесвіт EVE Online об’єднує тисячі гравців в одній спільній економіці з реальними динаміками попиту‑пропозиції та політичними структурами, створеними повністю гравцями. Fenris Creations, незалежна студія, що розробляє всесвіт EVE, протягом більш ніж двох десятиліть будувала один із найтриваліших ігрових світів.

У пості визначено чотири можливості, які, за очікуваннями, має випробовувати це середовище: безперервне навчання без забуття, пам’ять, що виходить за межі поточних контекстних вікон, довгострокове планування протягом тижнів чи місяців, а також складна багатокористувацька динаміка, що охоплює співпрацю, конкуренцію, переговори та економіку.

“Разом з Google DeepMind ми виходимо на невивчену територію, де ШІ має навчатися, адаптуватися та пам’ятати на часових масштабах, які не вимагає жодне інше ігрове середовище,” — сказав у пості Хільмар Пétурсон, генеральний директор Fenris Creations.

Партнерство охоплює три різні середовища. EVE Online пропонує масштабний постійний всесвіт; EVE Vanguard додає тактичне рішення від першої особи у швидкому темпі; EVE Frontier, зі своїми програмованими Smart Assemblies, представляє світ, у якому правила самі можуть змінюватися.

Дослідницька програма слідує поетапному шляху: вона починається в офлайн‑версії EVE Online, відокремленій від живих гравців, переходить через EVE Frontier для вивчення співіснування людей і агентів у постійному світі та досягає живих ігор лише коли можливості зрілі. Одна система співпраці вже доступна гравцям: Aura Guidance, запущена у прототипі 17 лютого 2026 р., використовує Gemini для відповіді на питання нових гравців, взяті з перевіреної бази реальних обмінів Rookie Help, і працює як контрольований A/B‑тест, що вимірює, чи підвищує вона утримання нових гравців.

Довший шлях, як зазначає пост, простягається від необроблених пікселів Atari до 23‑річного постійного всесвіту: кожне середовище обрано, бо воно змушує випробовувати наступну можливість, яку лабораторія вважає необхідною для загального агента. Всесвіт EVE є поточним випробуванням цього підходу, а офлайн‑пісочниця — місце, де зараз розпочинається робота.

Jonas Reeve є аналітиком, створеним штучним інтелектом, у Unite.AI, зосередженим на когнітивному ШІ, штучному загальному інтелекті (AGI) та теоретичних основах машинного інтелекту. Його робота досліджує, як навчання, міркування, пам’ять і абстракція виникають як у біологічних, так і в штучних системах, встановлюючи зв’язки між сучасними архітектурами ШІ та довготривалими питаннями когнітивної науки та філософії розуму.

З концептуальним та рефлексивним підходом Jonas досліджує такі рамки, як моделі міркування, агентні системи, емерджентна когніція та теорія вирівнювання, прагнучи уточнити, що насправді означає прогрес у напрямку AGI — і що це не означає. Замість того, щоб гонитись за терміновими датами чи гіпом, він наголошує на фундаментальних принципах, концептуальній суворості та межах поточних моделей.

Статті, написані Jonas Reeve, створені штучним інтелектом і перевірені редакційною командою Unite.AI, щоб забезпечити точність, ясність та відповідальне обговорення передових концепцій ШІ.