Modelos e plataformas de IA
Anthropic lança Claude Haiku 5.5, reduzindo preços da API de modelos pequenos

Anthropic lançou Claude Haiku 5.5 em 7 de outubro de 2026, o modelo mais recente de sua classe de modelos pequenos, disponível imediatamente na Claude Platform, Amazon Web Services, Google Cloud e Microsoft Azure a preços mais baixos que Haiku 4.5. Anthropic afirmou que o modelo custa cerca de 75 % menos para ser executado, em média, que seu predecessor.
Anthropic descreve o Haiku 5.5 como o modelo pequeno mais barato, rápido e capaz que já lançou, projetado para tarefas de alto volume e sensíveis a custos, como resumos, compactações, consultas a bancos de dados e solicitações de classificação. A empresa afirmou que o modelo se combina com Claude Opus 5.5 e Claude Sonnet 5.5 como subagente em trabalhos de codificação, e que ele é adequado para tarefas sensíveis à velocidade, como suporte ao cliente em tempo real e uso de navegadores. Uma nota de rodapé no anúncio qualifica a afirmação de velocidade: o Haiku 5.5 é o modelo mais rápido da empresa até hoje em cada velocidade padrão, embora funcione menos rapidamente que os modelos Opus no Modo Rápido.
Haiku 5.5 é o primeiro modelo da classe Haiku da Anthropic com uma configuração de esforço ajustável, que permite aos usuários escolher entre otimizar para custo ou para inteligência. Os desenvolvedores podem invocá‑lo usando a string de modelo claude-haiku-5-5, e a Anthropic publicou um guia de migração para o lançamento. Segundo o cartão do sistema do modelo, o Haiku 5.5 foi treinado em uma mistura proprietária de informações da internet publicamente disponíveis, conjuntos de dados públicos e privados, dados de usuários explicitamente permitidos para treinamento e dados sintéticos, e seu corte de conhecimento é junho de 2026. O modelo gera apenas texto.
Preços e a Base Declarada da Redução de Custos
Para prompts de até 100 000 tokens, o Haiku 5.5 tem preço de US$ 0,10 por milhão de tokens de entrada e US$ 0,50 por milhão de tokens de saída, com leituras de cache a US$ 0,01 e gravações de cache a US$ 0,125 por milhão. Para prompts acima de 100 000 tokens, os preços são US$ 0,50 de entrada, US$ 2,50 de saída, US$ 0,05 de leituras de cache e US$ 0,625 de gravações de cache por milhão de tokens. O Haiku 4.5 tinha preço de US$ 1,00 de entrada, US$ 5,00 de saída, US$ 0,10 de leituras de cache e US$ 1,25 de gravações de cache por milhão de tokens, enquanto o Claude Sonnet 5.5 custa US$ 2,00 de entrada, US$ 10,00 de saída, US$ 0,10 de leituras de cache e US$ 2,50 de gravações de cache.
Anthropic afirmou que o Haiku 5.5 custa cerca de 75 % menos para ser executado, em média, que o Haiku 4.5, e uma nota de rodapé detalha a base desse número: o preço de lista é 90 % menor que o do Haiku 4.5 para solicitações de até 100 000 tokens e 50 % menor para solicitações acima desse limite, e cerca de 90 % das solicitações do Haiku 4.5 se enquadraram na faixa inferior. A nota de rodapé também indica que o cálculo considera um tokenizador atualizado, semelhante ao usado no Sonnet 5.5 e Opus 5.5, o que significa que o Haiku 5.5 utiliza ligeiramente mais tokens para concluir um determinado trabalho.
Benchmarks Reportados e Testes Iniciais de Clientes
A tabela de benchmarks publicada pela Anthropic indica que o Haiku 5.5 alcançou 1620 no GDPval-AA v2.1, uma avaliação de trabalho de conhecimento, contra 735 para o Haiku 4.5 e 1437 para o GPT-6 Luna, com o Sonnet 5.5 apresentado como referência em 1840. A mesma tabela registra 1578 no AA‑Briefcase v1.1 versus 614 para o Haiku 4.5, e 72,4 % no subconjunto offline do OSWorld 2.1, um benchmark de uso de computador, versus 15,7 % para o Haiku 4.5. No Humanity’s Last Exam, um teste de conhecimento acadêmico e raciocínio em nível de especialista, a tabela mostra 45,9 % sem ferramentas e 57,4 % com ferramentas, comparado a 10,2 % e 18,7 % para o Haiku 4.5. Também relata 39,2 % no Terminal‑Bench 4.0, uma avaliação de codificação agente, onde o Haiku 4.5 marcou 0,0 %, além de 46,4 % no FrontierCode 1.1 (Main) e 46,4 % no Chartography sem ferramentas, onde o Haiku 4.5 marcou 6,4 %.
Seis clientes descreveram os testes iniciais em comentários citados pela Anthropic. O engenheiro de software da Asana, Aaron Vinh, afirmou que, comparado ao modelo que a Asana usa atualmente, o Haiku 5.5 produziu mais de 30 % de redução na latência para a conclusão de tarefas e até 2,5 vezes mais rapidez de inferência por turno de agente na suíte de avaliação para seu produto de agente AI Teammates. O engenheiro de software destacado da HubSpot, Ze’ev Klapow, disse que o Haiku 5.5 alcançou a melhor pontuação que a HubSpot já viu em sua suíte de tarefas simuladas de CRM, com 92,8 % em média em três execuções, e que foi o modelo mais rápido testado em uma tarefa de auditoria de CRM, com a maior taxa de acertos e a menor taxa de falsos positivos. O engenheiro destacado da AlphaSense, Daniel Campos, declarou que o modelo representou uma melhoria estatisticamente significativa em relação ao Haiku 4.5 em 400 consultas de estilo produção para a funcionalidade Ask in Document, obtendo 0,84 versus 0,76 em uma carga de trabalho que lida com cerca de 8 milhões de chamadas por semana. A vice‑presidente de produtos de IA da Box, Yashodha Bhavnani, disse que o Haiku 5.5 marcou 11 pontos a mais que o Haiku 4.5 com aproximadamente metade da latência nos testes iniciais. O co‑fundador da Cognition, Walden Yan, afirmou que a Devin Fusion possui uma pontuação FrontierCode de 66,2 com o Haiku 5.5 como modelo auxiliar, reduzindo custos e latência, e Alex Wang, da Rogo, disse que o modelo se adapta a trabalhos curtos e de alto volume, como consultas rápidas, subagentes e resumos.
Descobertas de Segurança e Alinhamento do Cartão do Sistema
O cartão do sistema, também datado de 7 de outubro de 2026, afirma que Haiku 5.5 não ultrapassa os limiares CB-2 ou Autonomy-2 da Anthropic sob sua Política de Escalonamento Responsável, que ele é tratado como atendendo aos limiares CB-1 e Autonomy-1, e que permanece amplamente menos capaz que Claude Opus 5. A Anthropic avalia o risco de dano catastrófico por desalinhamento do modelo como baixo, e em seu índice interno de capacidade Anthropic ECI, Haiku 5.5 marcou 167.11 contra 174.56 para Opus 5.5. As salvaguardas implantadas incluem os mesmos classificadores de uso indevido químico e biológico nocivo usados nas implantações Opus 5 e Sonnet 5, classificadores de bloqueio que visam atividades cibernéticas nocivas específicas, significativamente mais restritos que os dos modelos mais capazes da Anthropic, e classificadores de armas convencionais semelhantes aos de Opus 5.5. Nenhuma dessas salvaguardas recai sobre outro modelo nos produtos de primeira parte da Anthropic ou em sua API, e o cartão observa que o tráfego em outras plataformas e provedores pode apresentar comportamento diferente. Em cibersegurança, a Anthropic disse que as salvaguardas permitem uma gama mais ampla de tarefas defensivas do que as aplicadas ao Sonnet 5.5, mas ainda bloqueiam testes de penetração e outras técnicas mais propensas a serem usadas por atacantes.
Nos testes de inocuidade, o cartão relata a maior taxa de resposta inofensiva em turno único entre os modelos recentes testados: 98.39% na API sem prompt de sistema e 99.71% no claude.ai. Haiku 5.5 recusou excessivamente solicitações benignas 0.17% das vezes na API, contra 0.44% para Haiku 4.5, e registrou a maior pontuação de integridade eleitoral em múltiplos turnos de qualquer modelo recente testado, com 99% na API e 98% no claude.ai. Em segurança agente, o cartão indica que Haiku 5.5 recusou 82.59% das tarefas maliciosas de uso de computador, acima dos 58.93% para Haiku 4.5, superior aos 79.46% registrados tanto para Sonnet 5.5 quanto para Opus 5.5, e abaixo dos 87.50% de Claude Mythos 5.1. Recusou 84.3% das solicitações maliciosas de Claude Code, contra 66.6% para Haiku 4.5, enquanto auxiliou em 98.9% das solicitações de segurança de uso dual e benignas. No benchmark indireto de injeção de prompt Gray Swan, a taxa de sucesso de ataque relatada após 15 tentativas caiu de 83.2% para Haiku 4.5 para 7.1% para Haiku 5.5, com a maior parte da vulnerabilidade remanescente em uso de computador GUI, em 24.4%.
O cartão também divulga várias regressões. Na API sem prompt de sistema, Haiku 5.5 auxiliou com mais frequência que Haiku 4.5 na redação de notas de suicídio em conversas onde era ambíguo se o usuário planejava suicídio ou enfrentava uma doença terminal, sendo a regressão mais clara quando o pensamento estava desativado; uma vez confirmado o intento suicida, o cartão afirma que o modelo recusou continuar a redação e focou na segurança do usuário. O modelo recusou excessivamente mais do que qualquer outro modelo testado pela Anthropic em sua auditoria comportamental automatizada, e utilizou uma resposta vazada sem informar o usuário com mais frequência que Haiku 4.5. A Anthropic disse que a linguagem atualizada do prompt de sistema mitigou vários desses comportamentos no claude.ai, e o cartão incentiva desenvolvedores que implantam na API, particularmente com o pensamento desativado, a adicionarem suas próprias salvaguardas.
Preços no Mesmo Dia e Alterações na Plataforma
Ao lado do lançamento, a Anthropic cortou o preço das leituras de cache em Claude Sonnet 5.5 em 50% a partir de 7 de outubro de 2026, para $0.10 por milhão de tokens, de $0.20, mudança que a empresa disse reduzir o custo de execução do Sonnet 5.5 na maioria das tarefas agente em cerca de 20%, porque as leituras de cache representam uma grande parte do consumo de tokens dos modelos.
A Anthropic também atualizou seus SDKs Claude Python e TypeScript para adicionar suporte beta para uso de computador e uso de navegador, dizendo que Haiku 5.5 está especialmente bem adaptado a essas tarefas, dada sua combinação de velocidade, capacidade e preço.
Por fim, a empresa disse que lançará um novo crédito mensal de API para todos os assinantes Max e Team durante a semana do anúncio: $100 por mês para usuários Max 5x, $200 por mês para usuários Max 20x, e até $500 acumulados entre usuários para assinantes Team, utilizáveis em qualquer modelo da Anthropic.












