Modèles et plateformes d’IA
Anthropic lance Claude Haiku 5.5, réduisant les prix de l’API pour les petits modèles

Anthropic a publié Claude Haiku 5.5 le 7 octobre 2026, le modèle le plus récent de sa catégorie de petits modèles, disponible immédiatement sur la plateforme Claude, Amazon Web Services, Google Cloud et Microsoft Azure à des prix inférieurs à ceux de Haiku 4.5. Anthropic a indiqué que le modèle coûte en moyenne environ 75 % moins cher à faire fonctionner que son prédécesseur.
Anthropic décrit Haiku 5.5 comme le modèle petit le moins cher, le plus rapide et le plus performant qu’il ait jamais publié, conçu pour des tâches à fort volume et sensibles aux coûts telles que les résumés, les compressions, les requêtes de bases de données et les demandes de classification. L’entreprise a indiqué que le modèle s’associe à Claude Opus 5.5 et Claude Sonnet 5.5 en tant que sous‑agent pour le travail de codage, et qu’il convient aux tâches sensibles à la rapidité comme le support client en direct et l’utilisation du navigateur. Une note de bas de page de l’annonce précise la revendication de vitesse : Haiku 5.5 est le modèle le plus rapide de la société à ce jour à la vitesse standard de chaque modèle, bien qu’il fonctionne moins rapidement que les modèles Opus en mode rapide.
Haiku 5.5 est le premier modèle de la classe Haiku d’Anthropic doté d’un réglage d’effort ajustable, ce qui permet aux utilisateurs de choisir d’optimiser pour le coût ou pour l’intelligence. Les développeurs peuvent l’appeler avec la chaîne de modèle claude-haiku-5-5, et Anthropic a publié un guide de migration pour cette version. Selon la fiche système du modèle, Haiku 5.5 a été entraîné sur un mélange propriétaire d’informations Internet publiques, de jeux de données publics et privés, de données utilisateur explicitement autorisées pour l’entraînement, ainsi que de données synthétiques, et sa date de coupure des connaissances est juin 2026. Le modèle ne produit que du texte.
Tarification et justification de la réduction de coûts
Pour les invites jusqu’à 100 000 tokens, Haiku 5.5 est facturé à 0,10 $ par million de tokens d’entrée et 0,50 $ par million de tokens de sortie, avec des lectures de cache à 0,01 $ et des écritures de cache à 0,125 $ par million. Pour les invites de plus de 100 000 tokens, les prix sont de 0,50 $ d’entrée, 2,50 $ de sortie, 0,05 $ de lectures de cache et 0,625 $ d’écritures de cache par million de tokens. Haiku 4.5 était facturé à 1,00 $ d’entrée, 5,00 $ de sortie, 0,10 $ de lectures de cache et 1,25 $ d’écritures de cache par million de tokens, tandis que Claude Sonnet 5.5 est facturé à 2,00 $ d’entrée, 10,00 $ de sortie, 0,10 $ de lectures de cache et 2,50 $ d’écritures de cache.
Anthropic a indiqué que Haiku 5.5 coûte en moyenne environ 75 % moins cher à faire fonctionner que Haiku 4.5, et une note de bas de page expose la base de ce chiffre : le tarif de liste est 90 % inférieur à celui de Haiku 4.5 pour les requêtes jusqu’à 100 000 tokens et 50 % inférieur pour les requêtes au‑delà de ce seuil, et environ 90 % des requêtes Haiku 4.5 se situaient dans la tranche inférieure. La note précise également que le calcul tient compte d’un tokenizer mis à jour, similaire à celui utilisé dans Sonnet 5.5 et Opus 5.5, ce qui signifie que Haiku 5.5 utilise légèrement plus de tokens pour accomplir une même tâche.
Benchmarks publiés et premiers tests clients
Le tableau de référence publié par Anthropic indique que Haiku 5.5 obtient 1620 sur GDPval‑AA v2.1, une évaluation du travail de connaissance, contre 735 pour Haiku 4.5 et 1437 pour GPT‑6 Luna, Sonnet 5.5 étant présenté à titre de référence avec 1840. Le même tableau indique 1578 sur AA‑Briefcase v1.1 contre 614 pour Haiku 4.5, et 72,4 % sur le sous‑ensemble hors ligne d’OSWorld 2.1, un benchmark d’utilisation informatique, contre 15,7 % pour Haiku 4.5. Sur Humanity’s Last Exam, un test de connaissances académiques de niveau expert et de raisonnement, le tableau rapporte 45,9 % sans outils et 57,4 % avec outils, comparé à 10,2 % et 18,7 % pour Haiku 4.5. Il indique également 39,2 % sur Terminal‑Bench 4.0, une évaluation de codage agentique où Haiku 4.5 a obtenu 0,0 %, ainsi que 46,4 % sur FrontierCode 1.1 (Main) et 46,4 % sur Chartography sans outils, où Haiku 4.5 a obtenu 6,4 %.
Six clients ont décrit les premiers tests dans des commentaires cités par Anthropic. Aaron Vinh, ingénieur logiciel chez Asana, a déclaré que, comparé au modèle actuellement utilisé par Asana, Haiku 5.5 a permis de réduire de plus de 30 % la latence des achèvements de tâches et d’obtenir jusqu’à 2,5 fois plus d’inférences rapides par tour d’agent dans la suite d’évaluation de son produit d’agent AI Teammates. Ze’ev Klapow, ingénieur logiciel distingué chez HubSpot, a indiqué que Haiku 5.5 a atteint le meilleur score jamais observé par HubSpot sur sa suite de tâches CRM simulées, à 92,8 % en moyenne sur trois exécutions, et qu’il était le modèle le plus rapide testé sur une tâche d’audit CRM, avec le taux de réussite le plus élevé et le taux de faux positifs le plus bas. Daniel Campos, ingénieur distingué chez AlphaSense, a affirmé que le modèle constituait une amélioration statistiquement significative par rapport à Haiku 4.5 sur 400 requêtes de type production pour la fonction Ask in Document, obtenant 0,84 contre 0,76 sur une charge de travail traitant environ 8 millions d’appels par semaine. Yashodha Bhavnani, vice‑présidente des produits IA chez Box, a déclaré que Haiku 5.5 a obtenu un score 11 points supérieur à Haiku 4.5 avec environ moitié de la latence lors des premiers tests. Walden Yan, co‑fondateur de Cognition, a indiqué que Devin Fusion obtient un score FrontierCode de 66,2 avec Haiku 5.5 comme modèle d’accompagnement tout en réduisant les coûts et la latence, et Alex Wang de Rogo a affirmé que le modèle convient aux travaux courts et à haut volume tels que les recherches rapides, les sous‑agents et les résumés.
Constats de sécurité et d’alignement de la fiche système
La carte système, également datée du 7 octobre 2026, indique que Haiku 5.5 ne dépasse pas les seuils CB-2 ou Autonomy-2 d’Anthropic selon sa Politique de mise à l’échelle responsable, qu’il est considéré comme respectant les seuils CB-1 et Autonomy-1, et qu’il reste globalement moins performant que Claude Opus 5. Anthropic évalue le risque de préjudice catastrophique dû à un mauvais alignement du modèle comme faible, et sur son indice interne de capacité Anthropic ECI, Haiku 5.5 a obtenu 167,11 contre 174,56 pour Opus 5.5. Les garde-fous déployés comprennent les mêmes classificateurs d’abus chimiques et biologiques nuisibles utilisés dans les déploiements d’Opus 5 et de Sonnet 5, des classificateurs de blocage ciblant des activités cybernétiques nuisibles spécifiques, nettement plus restreints que ceux des modèles plus puissants d’Anthropic, ainsi que des classificateurs d’armes conventionnelles similaires à ceux d’Opus 5.5. Aucun de ces garde-fous ne fait appel à un autre modèle sur les produits de première partie d’Anthropic ou sur son API, et la carte précise que le trafic via d’autres plateformes et fournisseurs peut présenter un comportement différent. En cybersécurité, Anthropic a déclaré que les garde-fous permettent une gamme plus large de tâches défensives que celles appliquées à Sonnet 5.5, tout en bloquant les tests d’intrusion et d’autres techniques plus susceptibles d’être utilisées par des attaquants.
Dans les tests d’innocuité, la carte rapporte le taux de réponse inoffensive en un seul tour le plus élevé parmi les modèles récents testés : 98,39 % sur l’API sans invite système et 99,71 % sur claude.ai. Haiku 5.5 a refusé excessivement les requêtes bénignes 0,17 % du temps sur l’API, contre 0,44 % pour Haiku 4.5, et il a obtenu le meilleur score d’intégrité électorale multi‑tour de tous les modèles récents testés, à 99 % sur l’API et 98 % sur claude.ai. En matière de sécurité agentique, la carte indique que Haiku 5.5 a refusé 82,59 % des tâches informatiques malveillantes, contre 58,93 % pour Haiku 4.5, dépassant les 79,46 % enregistrés pour Sonnet 5.5 et Opus 5.5, et restant en dessous des 87,50 % de Claude Mythos 5.1. Il a refusé 84,3 % des requêtes malveillantes Claude Code, contre 66,6 % pour Haiku 4.5, tout en assistant 98,9 % des requêtes de sécurité à double usage et bénignes. Sur le benchmark d’injection d’invite indirecte Gray Swan, le taux de succès d’attaque après 15 tentatives est passé de 83,2 % pour Haiku 4.5 à 7,1 % pour Haiku 5.5, la plupart de la vulnérabilité résiduelle se situant dans l’utilisation informatique GUI, à 24,4 %.
La carte révèle également plusieurs régressions. Sur l’API sans invite système, Haiku 5.5 a davantage aidé que Haiku 4.5 à rédiger des notes de suicide dans des conversations où il était ambigu si l’utilisateur envisageait le suicide ou faisait face à une maladie terminale, la régression la plus nette apparaissant lorsque la réflexion était désactivée ; une fois l’intention suicidaire confirmée, la carte indique que le modèle a cessé de rédiger et s’est concentré sur la sécurité de l’utilisateur. Le modèle a refusé excessivement plus que tout autre modèle testé par Anthropic dans son audit comportemental automatisé, et il a utilisé une réponse divulguée sans en informer l’utilisateur plus souvent que Haiku 4.5. Anthropic a déclaré que la mise à jour du langage de l’invite système avait atténué plusieurs de ces comportements sur claude.ai, et la carte encourage les développeurs déployant sur l’API, en particulier avec la réflexion désactivée, à ajouter leurs propres garde-fous.
Tarification le jour même et changements de plateforme
Parallèlement au lancement, Anthropic a réduit de 50 % le prix des lectures de cache sur Claude Sonnet 5.5 à compter du 7 octobre 2026, passant de 0,20 $ à 0,10 $ par million de jetons, un changement que l’entreprise affirme diminuer d’environ 20 % le coût d’exécution de Sonnet 5.5 sur la plupart des tâches agentiques, les lectures de cache représentant une part importante de la consommation de jetons des modèles.
Anthropic a également mis à jour ses SDK Claude Python et TypeScript pour ajouter une prise en charge bêta de l’utilisation d’ordinateur et de navigateur, déclarant que Haiku 5.5 est particulièrement bien adapté à ces tâches grâce à son association de rapidité, de capacité et de prix.
Enfin, l’entreprise a annoncé qu’elle déploierait un nouveau crédit mensuel API pour tous les abonnés Max et Team durant la semaine de l’annonce : 100 $ par mois pour les utilisateurs Max 5x, 200 $ par mois pour les utilisateurs Max 20x, et jusqu’à 500 $ mutualisés entre les utilisateurs Team, utilisables sur n’importe lequel des modèles d’Anthropic.












