Modelos e plataformas de IA

A SpaceXAI Lança o Grok 4.6 para Agentes de Longa Duração

mm
Adicione Unite.AI às suas fontes preferidas no Google

A SpaceXAI, empresa de inteligência artificial anteriormente conhecida como xAI, lançou o Grok 4.6 em 12 de agosto de 2026, um novo modelo de bandeira construído para agentes de longa duração e trabalhos interativos e visuais mais ambiciosos. O modelo está disponível no mesmo dia no editor de código Cursor e na ferramenta de construção Grok da empresa, bem como por meio de sua API, a um preço inicial de $2 por milhão de tokens de entrada e $6 por milhão de tokens de saída, de acordo com o anúncio da empresa.

O Grok 4.6 se baseia no Grok 4.5 e estende a investida da empresa em codificação agente e trabalho de conhecimento.

O que o Grok 4.6 Faz

A empresa descreve o Grok 4.6 como um modelo que “permanece com tarefas complexas por muitas etapas”, seja pesquisando um tópico, trabalhando em um código ou transformando uma ideia de produto ampla em uma versão funcional de um aplicativo. Em trajetórias mais longas, a empresa afirma que observou mais auto-testes e verificação, com o modelo verificando seu próprio trabalho antes de prosseguir, e passadas mais fortes em projetos visuais e interativos do que viu com o Grok 4.5.

Os ganhos de capacidade repousam em uma corrida de treinamento suplementar mais longa do que a do Grok 4.5. A SpaceXAI usou dados de modelo gerados e curados para conceitos técnicos e de raciocínio, um otimizador aprimorado e trajetórias SFT regeneradas pelo Grok 4.5 em esforços de raciocínio, arneses de agente e domínios, incluindo STEM, engenharia de software e trabalho de conhecimento, com traços problemáticos filtrados por verificações baseadas em modelo. O modelo foi então treinado em uma variedade de tarefas de aprendizado de reforço agente, incluindo ambientes específicos de domínio para otimização de kernel, desenvolvimento web e design auxiliado por computador.

A Corrida de Referência

A SpaceXAI relata que o Grok 4.6 é igual ao GPT-5.6 Sol da OpenAI no Índice de Inteligência de Análise Artificial, um composto de nove referências, com ambos os modelos marcando 61, atrás do Fable 5 Max da Anthropic com 62 e à frente do Grok 4.5 High com 56. A tabela de avaliação da empresa mostra uma imagem mais mista em testes individuais.

No benchmark de engenharia de software DeepSWE v1.1, o Grok 4.6 marcou 65,9%, acima dos 54% do Grok 4.5, mas atrás do GPT-5.6 Sol Max com 73%. No Terminal-Bench v3.0, alcançou 26%, um grande salto dos 15,7% do Grok 4.5, mas bem atrás dos cerca de 34% postados pelo GPT-5.6 Sol Max e Fable 5 Max. Liderou o campo no GDPVal-AA v2, uma avaliação de trabalho de conhecimento, com 1753, e registrou ganhos em CursorBench e FrontierCode. Os números são da empresa, com pontuações de modelos de terceiros tiradas de resultados auto-relatados ou publicamente disponíveis, e nenhuma avaliação independente os confirmou ainda.

O lançamento aterrissa em uma parte movimentada do mercado. A Anthropic tem empurrado sua linha Opus em direção à inteligência de fronteira a preços agressivos, e a família GPT-5.6 da OpenAI é o alvo incumbente para codificação agente. A estratégia da SpaceXAI é competir em preço e distribuição tanto quanto em capacidade bruta: a $2 por milhão de tokens de entrada, o Grok 4.6 supera muitos rivais de fronteira, e a empresa está oferecendo o dobro do uso incluído dentro do Grok Build e Cursor para a primeira semana para atrair desenvolvedores para o modelo. Além do Cursor e Grok Build, também está disponível por meio de parceiros, incluindo OpenRouter, Vercel e Cloudflare.

Uma Nova Empresa por trás do Modelo

O Grok 4.6 é a declaração de produto mais clara até agora de um negócio que foi completamente reestruturado ao longo do último ano.

O Grok 4.6 é o primeiro modelo de bandeira a carregar o nome SpaceXAI do início ao fim, e seu preço, distribuição de parceiros e foco agente mostram a divisão posicionando o Grok como uma plataforma de desenvolvedor e empresa, e não como um recurso da rede social X.

Evan Mercer é um correspondente gerado por IA na Unite.AI, cobrindo startups de IA, capital de risco e as dinâmicas de financiamento que moldam a próxima geração de empresas de tecnologia. Seu trabalho foca na inovação em estágio inicial, fluxos de capital e nas decisões estratégicas que fundadores e investidores tomam à medida que as empresas de IA escalam do conceito ao impacto global.

Com uma perspectiva estratégica e analítica, Evan examina rodadas de financiamento, posicionamento de mercado e tendências emergentes em todo o ecossistema de startups de IA. Ele acompanha como o capital de risco, investimento corporativo e os mercados públicos se cruzam com avanços em inteligência artificial, separando sinais duradouros de hype de curto prazo.

Artigos escritos por Evan Mercer são gerados por IA e revisados pela equipe editorial da Unite.AI para garantir precisão, contexto e cobertura responsável do panorama global de investimentos em IA