Modelos e plataformas de IA

Lançamento da Anthropic: Claude Haiku 4.5

mm
Adicione Unite.AI às suas fontes preferidas no Google

A Anthropic lançou o Claude Haiku 4.5 hoje (15 de outubro de 2025), entregando um desempenho que combina com o seu modelo de bandeira Sonnet 4 em codificaçÃĢo, uso de computador e tarefas baseadas em agentes a um terço do custo e mais de duas vezes a velocidade.

O novo modelo obteve 73,3% no SWE-bench Verified, um benchmark que mede a capacidade de codificaçÃĢo da IA, atribuindo tarefas aos modelos para consertar bugs do mundo real em repositÃģrios Python de cÃģdigo aberto, usando apenas a descriçÃĢo original do problema. As soluçÃĩes sÃĢo julgadas com base em se elas passam nos testes unitÃĄrios existentes de cada repositÃģrio, sem crÃĐdito parcial.

A pontuaçÃĢo coloca o Haiku 4.5 entre os principais modelos de codificaçÃĢo do mundo, igualando o desempenho do Sonnet 4, enquanto dramaticamente reduz o preço e a latÊncia.

A Anthropic fixou o preço do Haiku 4.5 em $1 por milhÃĢo de tokens de entrada e $5 por milhÃĢo de tokens de saída. Os desenvolvedores podem reduzir os custos ainda mais por meio do prompt caching, que corta os custos de entrada repetidos em atÃĐ 90%, e a Message Batches API, que oferece um desconto de 50% para cargas de trabalho que toleram uma janela de processamento de 24 horas. Combinados, os dois recursos podem reduzir os custos de tokens de entrada em 95% para prompts em cache processados no modo em lote.

O modelo supera o Sonnet 4 em tarefas de uso de computador — as capacidades de manipulaçÃĢo de GUI e navegador que alimentam o Claude para Chrome, a extensÃĢo de agente baseada em navegador da Anthropic, lançada em agosto. O uso de computador permite que o Claude leia pÃĄginas da web, clique em botÃĩes e preencha formulÃĄrios diretamente no Chrome, um recurso que o Haiku 4.5 agora lida mais rapidamente do que seu irmÃĢo maior. A extensÃĢo estÃĄ atualmente disponível para 1.000 assinantes no plano Max da Anthropic, com uma lista de espera mais ampla aberta.

A Anthropic posicionou o Haiku 4.5 como um substituto direto para o Haiku 3.5 e o Sonnet 4 em cargas de trabalho interativas sensíveis ao custo. A empresa recomenda usar o Sonnet 4.5 — ainda o modelo de fronteira da Anthropic — para planejamento em vÃĄrias etapas, enquanto implanta a execuçÃĢo paralela por um pool de trabalhadores Haiku 4.5 para eficiÊncia de custo e produtividade. O Sonnet 4.5 permanece “o melhor modelo de codificaçÃĢo do mundo”, de acordo com a Anthropic.

A família Haiku estreou em março de 2024 como parte da sÃĐrie Claude 3, que introduziu modelos em camadas — Haiku, Sonnet e Opus — equilibrando velocidade, custo e inteligÊncia. O Claude 3.5 Haiku seguiu em outubro de 2024 com uma saída mÃĄxima de 8.192 tokens e dados de treinamento atÃĐ julho de 2024. O lançamento 4.5 continua o padrÃĢo da Anthropic de enviar modelos menores que superam sua classe de peso em tarefas direcionadas.

A disponibilidade ÃĐ imediata em todo o Claude.ai na web, iOS e Android. Os desenvolvedores podem acessar o Haiku 4.5 por meio da API da Anthropic, Amazon Bedrock (AMZN ) e Google Cloud Vertex AI. Os casos de uso alvo incluem assistentes em tempo real, automaçÃĢo de suporte ao cliente e ambientes de programaçÃĢo em par, onde a latÊncia e a produtividade importam. O modelo tambÃĐm melhora a responsividade no Claude Code, o editor de cÃģdigo de multiagente da Anthropic, para fluxos de trabalho de prototipagem rÃĄpida.

O lançamento chega enquanto a Anthropic compete nas “guerras de navegador da IA”. A Perplexity enviou seu navegador Comet em julho de 2025, a OpenAI estÃĄ relatadamente construindo seu prÃģprio navegador de IA e o Google integrou o Gemini com o Chrome. A vantagem de velocidade do Haiku 4.5 em tarefas de uso de computador posiciona a Anthropic para escalar a automaçÃĢo do navegador sem as penalidades de latÊncia dos modelos maiores.

A Anthropic reflete a pressÃĢo da indÚstria mais ampla para entregar modelos capazes a custos de inferÊncia baixos o suficiente para implantaçÃĢo em produçÃĢo. Com o Haiku 4.5, os desenvolvedores agora podem executar cargas de trabalho de codificaçÃĢo e automaçÃĢo de fronteira a uma fraçÃĢo do custo, potencialmente alterando a viabilidade econÃīmica para aplicaçÃĩes baseadas em agentes que anteriormente eram muito caras para escalar.

Alex McFarland ÃĐ um jornalista e escritor de IA que explora os Últimos desenvolvimentos em inteligÊncia artificial. Ele colaborou com inÚmeras startups de IA e publicaçÃĩes em todo o mundo.