Parcerias
Google DeepMind descreve como 15 anos de pesquisa em jogos levaram ao EVE Online

Google DeepMind publicou um relato detalhado de sua trajetória de 15 anos de pesquisa em IA aplicada a jogos, culminando na parceria de pesquisa com a Fenris Creations, o estúdio independente por trás de EVE Online, e apresentando o programa de pesquisa em etapas que as duas organizações planejam executar dentro do universo de EVE. O post de 21 de agosto de 2026 conecta os primeiros resultados de aprendizado por reforço do laboratório ao seu trabalho atual com agentes generalistas e nomeia as capacidades específicas que espera que o ambiente de EVE teste.
A retrospectiva cobre a cadeia de resultados em jogos que estruturou o programa de pesquisa do laboratório: a Deep Q‑Network que aprendeu 49 jogos de Atari 2600 a partir de pixels brutos, documentada em um artigo da Nature de 2015; a vitória do AlphaGo em 2016 sobre o campeão mundial Lee Sae Dol; AlphaGo Zero e AlphaZero, que eliminaram dados humanos e generalizaram entre xadrez, shogi e Go; MuZero, que jogou sem conhecer as regras; e AlphaStar, que atingiu nível de Grande Mestre em StarCraft II em 2019. O mesmo alicerce, observa o post, foi levado ao AlphaFold, o sistema de estrutura de proteínas reconhecido com o Prêmio Nobel de Química de 2024.
De dominar jogos a operar dentro deles
O post enquadra uma mudança na pesquisa de jogos do laboratório: afastar‑se de sistemas que dominam um único jogo com pontuação clara, rumo a agentes que podem operar em qualquer mundo de jogo como uma pessoa faria. O veículo para isso é o SIMA, o Scalable Instructable Multiworld Agent, que percebe o que o jogador vê na tela e age por meio de controles comuns de teclado e mouse, sem acesso ao código do jogo.
SIMA 2, apresentado em novembro de 2025 com um modelo Gemini como núcleo, avançou além do repertório de mais de 600 habilidades de seguir instruções da primeira versão, incorporando raciocínio sobre metas, conversas com usuários e aprimoramento por meio de jogo autodirigido. O Google DeepMind relata que o SIMA 2 reduz significativamente a lacuna em relação ao desempenho humano na conclusão de tarefas em seus ambientes de treinamento, inclusive em jogos nos quais nunca foi treinado, como ASKA e uma implementação de pesquisa em Minecraft. Os limites declarados pelo laboratório: o agente ainda tem dificuldade com tarefas de horizonte muito longo, opera com memória curta limitada pela janela de contexto necessária para interação de baixa latência e está disponível apenas como pré‑visualização de pesquisa limitada a um pequeno grupo de acadêmicos e desenvolvedores de jogos.
O que a parceria com a EVE acrescenta
A parceria com a Fenris Creations, revelada no início deste ano quando o estúdio por trás de EVE Online se tornou independente, concede ao DeepMind acesso a um mundo persistente que funciona continuamente desde 2003. O universo de um único shard de EVE Online reúne milhares de jogadores em uma economia compartilhada com dinâmicas reais de oferta e demanda e estruturas políticas construídas integralmente pelos próprios jogadores. A Fenris Creations, estúdio independente responsável pelo Universo EVE, dedica mais de duas décadas à construção de um dos mundos mais persistentes dos games.
O post identifica quatro capacidades que o ambiente deve exercitar: aprendizado contínuo sem esquecimento, memória que se estende além das janelas de contexto atuais, planejamento de longo horizonte ao longo de semanas ou meses e dinâmicas multi‑agente complexas que englobam cooperação, competição, negociação e economia.
“Junto com o Google DeepMind, estamos avançando para um território inexplorado onde a IA deve aprender, adaptar‑se e lembrar em escalas de tempo que nenhum outro ambiente de jogo exige”, disse Hilmar Pétursson, CEO da Fenris Creations, no post.
A parceria se estende por três ambientes distintos. EVE Online oferece o vasto universo persistente; EVE Vanguard adiciona decisões táticas em primeira pessoa e ritmo acelerado; EVE Frontier, com suas Smart Assemblies programáveis, apresenta um mundo onde as próprias regras podem mudar.
O programa de pesquisa segue um caminho em etapas: começa em uma instância offline de EVE Online separada dos jogadores ao vivo, avança para EVE Frontier para estudar como humanos e agentes coexistem em um mundo persistente e só chega aos jogos ao vivo quando as capacidades estiverem maduras. Um sistema da colaboração já está diante dos jogadores: Aura Guidance, lançado em protótipo em 17 de fevereiro de 2026, usa Gemini para responder a perguntas de novos jogadores extraídas de um banco verificado de trocas reais de Rookie Help, e está sendo testado em um experimento controlado A/B para medir se melhora a retenção de novos jogadores.
A trajetória mais longa, como o post descreve, vai dos pixels crus do Atari a um universo persistente de 23 anos: cada ambiente foi escolhido porque força a próxima capacidade que o laboratório acredita que um agente geral precisa. O universo de EVE é o teste atual dessa abordagem, e a sandbox offline é onde o trabalho agora começa.












