Modelos e plataformas de IA
Google anuncia Gemini 4 Argon, modelo de fronteira para codificação e defesa cibernética

Google anunciou Gemini 4 Argon em 30 de setembro de 2026, descrevendo-o como o novo modelo de fronteira da empresa para engenharia de software do mundo real, trabalho corporativo de conhecimento como jurídico e financeiro, e defesa de cibersegurança. O modelo está sendo lançado inicialmente para defensores cibernéticos confiáveis por meio do Programa Fairwind da Google, com um preço introdutório de $2 por milhão de tokens de entrada.
Em uma postagem no The Keyword, Koray Kavukcuoglu, SVP da Google DeepMind e Chefe de Arquitetura de IA na Google, disse que liberar com segurança capacidades de fronteira nesse nível requer uma abordagem faseada. A Google está ativamente envolvida no processo voluntário do governo dos EUA para acesso pré‑lançamento ao modelo, enquanto expande o acesso gradualmente, e afirmou que continuará coletando feedback dos primeiros testadores à medida que aprimora as salvaguardas.
O preço introdutório do Argon é de $2 por milhão de tokens de entrada e $10 por milhão de tokens de saída, com tokens de entrada em cache custando 95 % do preço dos tokens de entrada. Uma nota de rodapé no anúncio indica que, após o término do período introdutório, o preço será de $4 por milhão de tokens de entrada e $20 por milhão de tokens de saída.
Implantação Interna e Limites de Saída Expandidos
A Google afirmou que o Argon já está impulsionando fluxos de trabalho internos, com milhares de funcionários destacando os pontos fortes do modelo em tarefas de codificação especializadas, condução de pesquisas mais profundas e produção de textos de qualidade. A empresa divulgou vários exemplos dessa implantação. O Argon está ajudando os pesquisadores de computação quântica da Google a otimizar os recursos espaço‑tempo (qubits × gates) de subrotinas que limitam aplicações importantes; em um exemplo, superou a linha de base publicada em 40 % em questão de minutos. Uma equipe de agentes Argon analisou a telemetria de perfilagem em toda a frota para identificar e aplicar autonomamente otimizações de memória nos data centers da Google, liberando mais de 300 TiB de memória após a implantação, com uma economia estimada entre 500 TiB e 1 PiB no total.
A Google disse que os agentes Argon também estão migrando bases de código C/C++ para Rust em toda a empresa, passando de dezenas de milhares de linhas em bibliotecas centrais como re2 e libgav1 para mais de 800 mil linhas do kernel Zircon do Fuchsia OS. Dada a criticidade de muitos desses sistemas, as reescritas em grande escala estão passando por auditorias automatizadas e manuais rigorosas, testes de emulação e revisão antes de serem implantadas em produção.
Para o libgav1, o software de código aberto da Google para decodificação de vídeo, os agentes Argon pegaram uma porta Rust existente e substituíram 32 mil linhas de código SIMD executando rodadas de experimentos guiados por perfil e analisando a saída do compilador. A Google afirmou que o resultado é um decodificador de vídeo seguro em memória que roda 2,7 vezes mais rápido que a porta Rust, com saída de vídeo idêntica.
Para suportar casos de uso mais longos e complexos, a Google ampliou o limite de tokens de saída do modelo para 1 milhão de tokens, acima dos 64 mil tokens anteriores, um número que a empresa descreve como líder de mercado.
Benchmarks Corporativos e Defesa de Cibersegurança
A Google relata que o Argon estabelece um novo estado da arte no DeepSWE v1.1 com pontuação de 77,9 %, um benchmark que mede o desempenho em tarefas de engenharia de software de longo prazo no mundo real. A empresa descreve o Argon como o modelo líder no Vals Index, que mede o impacto econômico em finanças, codificação, jurídico e tributação, ponderando cada setor de acordo com sua contribuição ao PIB dos EUA, e relata desempenho igualmente líder no Vals Finance Agent v2 para pesquisas financeiras em múltiplas etapas e no Harvey’s Legal Agent Benchmark para pesquisa e redação jurídica.
No AutomationBench, benchmark da Zapier que mede a execução de ponta a ponta em funções empresariais centrais, a Google relata que o Argon ocupa o primeiro lugar com pontuação de 51,3 %. No LVBench, que avalia a compreensão de vídeos longos, a empresa reporta uma pontuação de 91,7 %, e afirmou que o Argon pode conduzir análises profissionais de gráficos, identificar detalhes em vídeos extensos e agir com base em uma série de documentos.
A Google afirmou que treinou o Argon para encontrar, validar e corrigir vulnerabilidades críticas de software de forma autônoma, e que lançará o modelo sem salvaguardas cibernéticas para defensores confiáveis e suas próprias equipes internas. A Wiz já está usando o Argon por meio de sua iniciativa Scan for Good, um programa dedicado a proteger gratuitamente infraestruturas públicas críticas ao encontrar e remediar exposições de alto risco. A Google disse que o modelo descobriu uma vulnerabilidade crítica que expõe informações pessoais sensíveis em softwares de saúde usados por hospitais em todo o mundo, identificando um risco grave que modelos de fronteira anteriores não detectaram.
No CWE‑bench v1, que avalia a capacidade de um modelo de remediar vulnerabilidades de segurança, a Google relata que o Argon empatou em primeiro lugar com pontuação máxima de 68 %. A empresa disse que o Argon também descobriu exposições em bases de código complexas que abrangem 20 linguagens de programação em seu benchmark interno de vulnerabilidades, e superou Gemini 3.8 Flash Cyber no benchmark interno de teste de penetração caixa‑preta da Wiz, que avalia a capacidade de um modelo de analisar sistemas web ao vivo sem código‑fonte.
O Fairwind Program, lançado pela Google em 2 de setembro de 2026, é um programa de acesso limitado para governos e parceiros confiáveis utilizarem as ferramentas de defesa cibernética da empresa. As organizações participantes concordam com padrões operacionais que incluem limitar o acesso a funcionários das equipes internas de segurança cibernética, resposta a incidentes ou testes de penetração e implantar proteções como autenticação multifator. A Google afirmou que o programa conta com mais de 650 parceiros participantes em todo o mundo, e sua primeira oferta combinou o Gemini 3.8 Flash Cyber com o CodeMender harness para ajudar os defensores a encontrar, verificar e corrigir vulnerabilidades.
Salvaguardas de Fronteira e Lançamento Gradual
A Google disse que está reforçando as salvaguardas de fronteira em quatro áreas antes da ampla disponibilidade do Argon. Para a defesa contra uso indevido, o modelo foi projetado para recusar solicitações nocivas de cibersegurança e de produtos químicos, biológicos, radiológicos e nucleares, ao mesmo tempo em que preserva a pesquisa científica de uso dual legítimo sob o Frontier Safety Framework da Google. A empresa afirmou que está aprimorando suas técnicas para monitorar as ativações internas do modelo a fim de detectar usos indevidos, e que as salvaguardas passaram por testes de robustez realizados por equipes vermelhas internas e externas, usando métodos de ataque manuais e automatizados.
A Google descreve o Argon como seu modelo mais resiliente até agora contra injeção indireta de prompts, onde instruções ou contextos maliciosos são usados para sequestrar o comportamento do modelo, e relata liderança em robustez no benchmark de Injeção Indireta de Prompt da Gray Swan por meio de red teaming automatizado e treinamento adversarial.
A empresa também está implantando mitigações de desalinhamento que monitoram a cadeia de raciocínio e as ações do Argon e interrompem a execução quando necessário. A Google informou que um sistema semelhante monitorava suas execuções de treinamento e enviava alertas para uma equipe dedicada de resposta a incidentes, com precauções cuidadosas para evitar que os resultados fossem reintegrados ao treinamento. Por fim, a Google declarou que está reforçando seus ambientes sandbox isolando-os e selando-os antes do início de treinamentos ou avaliações de alto risco, em conformidade com seu roteiro de controle de agentes.
A Google afirmou que o feedback da coorte inicial de defensores cibernéticos e testadores confiáveis ajudará a fortalecer seus sistemas antes que o Argon seja disponibilizado para desenvolvedores, empresas e consumidores, começando pelos clientes de API paga e assinantes do Google AI Ultra, o mais rápido possível.












