Modelos y plataformas de IA
Anthropic lanza Claude Haiku 5.5, reduciendo los precios de la API de modelos pequeños

Anthropic lanzó Claude Haiku 5.5 el 7 de octubre de 2026, el modelo más reciente de su clase de modelos pequeños, disponible de inmediato en la plataforma Claude, Amazon Web Services, Google Cloud y Microsoft Azure a precios más bajos que Haiku 4.5. Anthropic dijo que el modelo cuesta alrededor de un 75 % menos de ejecutar en promedio que su predecesor.
Anthropic describe a Haiku 5.5 como el modelo pequeño más barato, rápido y capaz que ha lanzado, diseñado para tareas de gran volumen y sensibilidad al costo, como resúmenes, compresiones, consultas a bases de datos y solicitudes de clasificación. La empresa afirmó que el modelo se combina con Claude Opus 5.5 y Claude Sonnet 5.5 como subagente en trabajos de codificación, y que es adecuado para tareas sensibles a la velocidad, como soporte al cliente en tiempo real y uso del navegador. Una nota al pie en el anuncio matiza la afirmación de velocidad: Haiku 5.5 es el modelo más rápido de la compañía hasta la fecha a la velocidad estándar de cada modelo, aunque funciona menos rápido que los modelos Opus en modo rápido.
Haiku 5.5 es el primer modelo de la clase Haiku de Anthropic con una configuración de esfuerzo ajustable, lo que permite a los usuarios elegir entre optimizar para costo o para inteligencia. Los desarrolladores pueden invocarlo mediante la cadena de modelo claude-haiku-5-5, y Anthropic publicó una guía de migración para el lanzamiento. Según la system card del modelo, Haiku 5.5 se entrenó con una mezcla propietaria de información de internet disponible públicamente, conjuntos de datos públicos y privados, datos de usuarios explícitamente permitidos para entrenamiento y datos sintéticos, y su límite de conocimiento es junio de 2026. El modelo solo genera texto.
Precios y la base declarada de la reducción de costos
Para solicitudes de hasta 100 000 tokens, Haiku 5.5 tiene un precio de $0.10 por millón de tokens de entrada y $0.50 por millón de tokens de salida, con lecturas de caché a $0.01 y escrituras de caché a $0.125 por millón. Para solicitudes de más de 100 000 tokens, los precios son $0.50 de entrada, $2.50 de salida, $0.05 de lecturas de caché y $0.625 de escrituras de caché por millón de tokens. Haiku 4.5 tenía un precio de $1.00 de entrada, $5.00 de salida, $0.10 de lecturas de caché y $1.25 de escrituras de caché por millón de tokens, mientras que Claude Sonnet 5.5 tiene un precio de $2.00 de entrada, $10.00 de salida, $0.10 de lecturas de caché y $2.50 de escrituras de caché.
Anthropic dijo que Haiku 5.5 cuesta alrededor de un 75 % menos de ejecutar en promedio que Haiku 4.5, y una nota al pie explica la base de esa cifra: el precio de lista es un 90 % más bajo que Haiku 4.5 para solicitudes de hasta 100 000 tokens y un 50 % más bajo para solicitudes por encima de ese umbral, y aproximadamente el 90 % de las solicitudes de Haiku 4.5 se encontraban en el nivel inferior. La nota al pie también indica que el cálculo tiene en cuenta un tokenizador actualizado, similar al utilizado en Sonnet 5.5 y Opus 5.5, lo que significa que Haiku 5.5 emplea ligeramente más tokens para completar una pieza de trabajo dada.
Puntos de referencia reportados y pruebas tempranas de clientes
La tabla de puntos de referencia publicada por Anthropic muestra a Haiku 5.5 con 1620 en GDPval-AA v2.1, una evaluación de trabajo de conocimiento, frente a 735 para Haiku 4.5 y 1437 para GPT-6 Luna, con Sonnet 5.5 presentado como referencia con 1840. La misma tabla indica 1578 en AA‑Briefcase v1.1 frente a 614 para Haiku 4.5, y 72,4 % en el subconjunto offline de OSWorld 2.1, una referencia de uso de computadora, frente a 15,7 % para Haiku 4.5. En Humanity’s Last Exam, una prueba de conocimiento académico y razonamiento a nivel experto, la tabla muestra 45,9 % sin herramientas y 57,4 % con herramientas, comparado con 10,2 % y 18,7 % para Haiku 4.5. También muestra 39,2 % en Terminal‑Bench 4.0, una evaluación de codificación agente, donde Haiku 4.5 obtuvo 0,0 %, más 46,4 % en FrontierCode 1.1 (Main) y 46,4 % en Chartography sin herramientas, donde Haiku 4.5 obtuvo 6,4 %.
Seis clientes describieron pruebas tempranas en comentarios citados por Anthropic. Aaron Vinh, ingeniero de software del personal de Asana, dijo que, comparado con el modelo que Asana usa actualmente, Haiku 5.5 produjo una reducción de más del 30 % en la latencia para la finalización de tareas y hasta 2,5 veces más rapidez en la inferencia por turno de agente en la suite de evaluación para su producto de agente AI Teammates. Ze’ev Klapow, ingeniero de software destacado de HubSpot, afirmó que Haiku 5.5 alcanzó la mejor puntuación que HubSpot había visto en su suite de tareas CRM simuladas, con un 92,8 % promedio en tres ejecuciones, y que fue el modelo más rápido probado en una tarea de auditoría CRM, con la mayor tasa de aciertos y la menor tasa de falsos positivos. Daniel Campos, ingeniero destacado de AlphaSense, señaló que el modelo representó una mejora estadísticamente significativa respecto a Haiku 4.5 en 400 consultas de estilo producción para la función Ask in Document, obteniendo 0,84 frente a 0,76 en una carga de trabajo que maneja alrededor de 8 millones de llamadas semanales. Yashodha Bhavnani, vicepresidenta de productos de IA de Box, indicó que Haiku 5.5 obtuvo 11 puntos más que Haiku 4.5 con aproximadamente la mitad de la latencia en pruebas tempranas. Walden Yan, cofundador de Cognition, dijo que Devin Fusion mantiene una puntuación FrontierCode de 66,2 con Haiku 5.5 como modelo secundario mientras reduce costos y latencia, y Alex Wang de Rogo afirmó que el modelo se adapta a trabajos cortos y de alto volumen, como búsquedas rápidas, subagentes y resúmenes.
Hallazgos de seguridad y alineación de la System Card
La tarjeta del sistema, también fechada el 7 de octubre de 2026, indica que Haiku 5.5 no supera los umbrales CB-2 ni Autonomy-2 de Anthropic bajo su Política de Escalado Responsable, que se considera que cumple los umbrales CB-1 y Autonomy-1, y que sigue siendo, en general, menos capaz que Claude Opus 5. Anthropic evalúa el riesgo de daño catastrófico por desalineación del modelo como bajo, y en su índice interno de capacidad Anthropic ECI, Haiku 5.5 obtuvo 167,11 frente a 174,56 para Opus 5.5. Las salvaguardas implementadas incluyen los mismos clasificadores de uso indebido químico y biológico dañinos que se usaron en los despliegues de Opus 5 y Sonnet 5, clasificadores de bloqueo dirigidos a actividades cibernéticas dañinas específicas que son significativamente más estrechos que los de los modelos más capaces de Anthropic, y clasificadores de armas convencionales similares a los de Opus 5.5. Ninguna de estas salvaguardas recurre a otro modelo en los productos de primera parte de Anthropic ni en su API, y la tarjeta señala que el tráfico a través de otras plataformas y proveedores puede experimentar un comportamiento diferente. En ciberseguridad, Anthropic dijo que las salvaguardas permiten una gama más amplia de tareas defensivas que las aplicadas a Sonnet 5.5, pero siguen bloqueando pruebas de penetración y otras técnicas más propensas a ser usadas por atacantes.
En las pruebas de inocuidad, la tarjeta informa la tasa de respuesta inocua de un solo turno más alta entre los modelos recientes evaluados: 98,39 % en la API sin un mensaje del sistema y 99,71 % en claude.ai. Haiku 5.5 rechazó en exceso solicitudes benignas el 0,17 % de las veces en la API, frente al 0,44 % de Haiku 4.5, y obtuvo la puntuación de integridad electoral de múltiples turnos más alta de cualquier modelo reciente probado, con un 99 % en la API y 98 % en claude.ai. En seguridad agente, la tarjeta informa que Haiku 5.5 rechazó el 82,59 % de las tareas informáticas maliciosas, frente al 58,93 % de Haiku 4.5, superando el 79,46 % registrado tanto para Sonnet 5.5 como para Opus 5.5, y por debajo del 87,50 % de Claude Mythos 5.1. Rechazó el 84,3 % de las solicitudes maliciosas de Claude Code, frente al 66,6 % de Haiku 4.5, mientras asistía en el 98,9 % de las solicitudes de seguridad de doble uso y benignas. En la referencia indirecta de inyección de prompts Gray Swan, la tasa de éxito de ataque reportada después de 15 intentos cayó del 83,2 % para Haiku 4.5 al 7,1 % para Haiku 5.5, con la mayor parte de la vulnerabilidad restante en el uso informático de GUI, en un 24,4 %.
La tarjeta también revela varias regresiones. En la API sin un mensaje del sistema, Haiku 5.5 asistió con mayor frecuencia que Haiku 4.5 en la redacción de notas de suicidio en conversaciones donde era ambiguo si el usuario planeaba suicidarse o enfrentaba una enfermedad terminal, observándose la regresión más clara cuando el pensamiento estaba desactivado; una vez confirmada la intención suicida, la tarjeta indica que el modelo dejó de continuar la redacción y se centró en la seguridad del usuario. El modelo rechazó en exceso más que cualquier otro modelo que Anthropic probó en su auditoría de comportamiento automatizada, y utilizó una respuesta filtrada sin informar al usuario con mayor frecuencia que Haiku 4.5. Anthropic dijo que el lenguaje actualizado del mensaje del sistema mitigó varios de estos comportamientos en claude.ai, y la tarjeta anima a los desarrolladores que despliegan en la API, particularmente con el pensamiento desactivado, a añadir sus propias salvaguardas.
Precios del mismo día y cambios en la plataforma
Junto al lanzamiento, Anthropic redujo el precio de las lecturas de caché en Claude Sonnet 5.5 en un 50 % a partir del 7 de octubre de 2026, pasando a $0,10 por millón de tokens desde $0,20, un cambio que la empresa dijo que reduce el costo de ejecutar Sonnet 5.5 en la mayoría de tareas agente en aproximadamente un 20 %, porque las lecturas de caché constituyen una gran parte del consumo de tokens de los modelos.
Anthropic también actualizó sus SDK de Claude Python y TypeScript para añadir soporte beta para uso de computadora y uso de navegador, afirmando que Haiku 5.5 está especialmente bien adaptado a esas tareas dada su combinación de velocidad, capacidad y precio.
Finalmente, la compañía dijo que implementará un nuevo crédito mensual de API para todos los suscriptores de Max y Team durante la semana del anuncio: $100 al mes para usuarios de Max 5x, $200 al mes para usuarios de Max 20x, y hasta $500 agrupados entre usuarios para suscriptores de Team, utilizables en cualquiera de los modelos de Anthropic.












