Modelos e plataformas de IA

Grok 4.6 está agora disponível de forma geral no Amazon Bedrock

mm
Adicione Unite.AI às suas fontes preferidas no Google

O modelo principal da xAI tem um segundo grande lar na nuvem. Grok 4.6 está agora disponível de forma geral no Amazon Bedrock, a empresa anunciou em 19 de agosto de 2026, uma semana após o lançamento inicial do modelo. No Bedrock, o modelo tem preço de $2 por milhão de tokens de entrada e $6 por milhão de tokens de saída, com uma janela de contexto de 500,000 tokens e quatro configurações configuráveis de esforço de raciocínio: low, medium, high, and xhigh.

A AWS confirmou a listagem no mesmo dia, afirmando que o Grok 4.6 está disponível em todas as regiões da AWS onde o Amazon Bedrock é oferecido, e enquadrando a adição em torno da segurança corporativa, monitoramento e inferência entre regiões. O modelo está no catálogo do Bedrock sob o ID de modelo xai.grok-4.6.

O cartão de modelo Grok 4.6 no guia do usuário do Bedrock mostra uma implantação significativamente mais ampla que a listagem anterior do Grok no serviço. O Grok 4.6 funciona em ambos os endpoints do Bedrock: bedrock-mantle, o motor de inferência que suportou o primeiro lançamento do Grok, e o endpoint padrão bedrock-runtime, onde pode ser acessado por meio de perfis de inferência Geo e Global entre regiões em mais de 30 regiões da AWS. O endpoint mantle serve o modelo In-Region a partir de us-west-2 (Oregon).

A AWS lista preços do lado do Bedrock em $2.20 por milhão de tokens de entrada e $6.60 por milhão de tokens de saída para solicitações In-Region e Geo entre regiões, com inferência Global entre regiões a $2.00 e $6.00, além de preço de leitura em cache de $0.55 por milhão de tokens para solicitações In-Region e Geo e $0.50 para inferência Global entre regiões. As modalidades abrangem entrada de texto e imagem com saída apenas de texto, conforme o cartão de modelo.

Grok 4.6 no Amazon Bedrock por Números

  • Janela de contexto: 500,000 tokens, conforme anúncio da xAI
  • Preço direto: $2 por milhão de tokens de entrada, $6 por milhão de tokens de saída
  • Preço no Bedrock: $2.20 / $6.60 por milhão de tokens In-Region; $2.00 / $6.00 via inferência Global entre regiões, conforme o cartão de modelo da AWS
  • Índice de Inteligência de Análise Artificial: 61, acima de 56 para Grok 4.5 High, conforme a tabela de avaliação do dia de lançamento da xAI
  • Presença regional: mais de 30 regiões da AWS no endpoint bedrock-runtime

O que o Grok 4.6 mudou em relação ao Grok 4.3 no Bedrock

Este é o segundo modelo Grok a chegar ao Amazon Bedrock. Grok 4.3 entrou no catálogo em junho de 2026 como a primeira listagem da xAI como provedora de modelo Bedrock, com preço de $1.25 por milhão de tokens de entrada e $2.50 por milhão de tokens de saída com uma janela de contexto de 1 milhão de tokens, servida exclusivamente através do endpoint mantle.

O Grok 4.6 eleva os preços — $2 e $6 por milhão de tokens em comparação aos $1.25 e $2.50 do Grok 4.3 — ao mesmo tempo que reduz pela metade a janela de contexto declarada para 500,000 tokens e adiciona um quarto nível de raciocínio, xhigh, acima da configuração alta anterior. Enquanto o Grok 4.3 chegou ao Bedrock em 17 de junho de 2026, o Grok 4.6 fez a transição em sete dias. O suporte mais amplo ao bedrock-runtime também move o Grok de uma implantação de única região e único endpoint para o sistema de inferência entre regiões do Bedrock, que é como as empresas na AWS normalmente roteiam cargas de trabalho de produção.

O que o Grok 4.6 traz

O Grok 4.6 foi lançado em 12 de agosto de 2026 como o modelo principal da xAI para agentes de longa duração e trabalhos interativos e visuais, chegando primeiro ao Cursor e ao ambiente Grok Build da empresa. Unite.AI cobriu o lançamento e, dois dias depois, a expansão do modelo para o GitHub Copilot em oito superfícies de desenvolvimento.

Na tabela de avaliação do dia de lançamento da xAI, o Grok 4.6 High obtém 61 no Índice de Inteligência de Análise Artificial, um composto de nove benchmarks, contra 56 para o Grok 4.5 High — nível com o GPT-5.6 Sol Max e um ponto atrás do líder da tabela, Fable 5 Max, que tem 62. Os resultados publicados pela empresa mostram ganhos maiores de geração sobre geração nas suítes agenticas: 65,9% versus 54% no DeepSWE v1.1, 57,5% versus 47,1% no APEX-Agents e 26% versus 15,7% no Terminal-Bench v3.0. Estes são números reportados pelo fornecedor; a xAI observa que as pontuações de terceiros na tabela são as melhores entre as auto‑relatadas ou disponíveis publicamente.

A receita de treinamento por trás desses números, como a empresa descreve, combina uma execução suplementar de treinamento mais longa em dados de raciocínio e engenharia gerados pelo modelo, com trajetórias de ajuste fino supervisionado regeneradas pelo Grok 4.5 em diferentes esforços de raciocínio e harnesses de agentes, seguida de aprendizado por reforço em tarefas agenticas que abrangem trabalho de conhecimento, codificação geral, otimização de kernel, desenvolvimento web e design assistido por computador.

Como as equipes acessam o Grok 4.6 no Bedrock

Os desenvolvedores invocam o modelo através do SDK da OpenAI apontado para uma URL base do Bedrock, ou através da própria API Converse da AWS no endpoint runtime. O raciocínio está ativo por padrão na configuração baixa, e o conteúdo de raciocínio criptografado pode ser retornado e repassado ao longo de turnos para conversas de múltiplas interações, conforme o cartão de modelo. O suporte a recursos divide‑se por endpoint: o uso de ferramentas no lado do servidor não é suportado no runtime, enquanto o lado mantle oferece chamada de ferramentas no cliente e detecção de abuso; o cache de prompts funciona em ambos.

Para a AWS, a listagem amplia uma série de adições de fronteira de terceiros ao catálogo: os modelos de defesa cibernética Daybreak da OpenAI chegaram ao Bedrock no início deste mês, e a plataforma adicionou recentemente busca web integrada para respostas fundamentadas. Para a xAI, a distribuição no Bedrock coloca o Grok 4.6 dentro do perímetro de aquisição, identidade e conformidade onde os clientes corporativos da AWS já executam suas inferências.

Jonas Reeve é um analista gerado por IA na Unite.AI, com foco em inteligência artificial cognitiva, inteligência artificial geral (AGI) e fundamentos teóricos de inteligência de máquina. Seu trabalho explora como aprendizado, raciocínio, memória e abstração surgem em sistemas biológicos e artificiais, estabelecendo conexões entre arquiteturas de IA modernas e questões de longa data em ciência cognitiva e filosofia da mente.
Com uma abordagem conceitual e reflexiva, Jonas examina estruturas como modelos de raciocínio, sistemas agênticos, cognição emergente e teoria de alinhamento, visando esclarecer o que o progresso em direção à AGI realmente significa - e o que não significa. Em vez de perseguir cronogramas ou hype, ele enfatiza princípios fundamentais, rigor conceitual e os limites dos modelos atuais.
Artigos escritos por Jonas Reeve são gerados por IA e revisados pela equipe editorial da Unite.AI para garantir precisão, clareza e discussão responsável de conceitos de IA avançados.