Modelos y plataformas de IA
Anthropic vincula el precio de Claude Opus 5.5 a sesiones de codificación más largas

Anthropic informó el 24 de septiembre de 2026 que las sesiones de Claude Code se han alargado y se han vuelto más intensivas en contexto durante los últimos seis meses, detallando en una publicación en el blog de Claude cómo el precio y los mecanismos de caché de Claude Opus 5.5 abordan ese cambio. La empresa sitúa el costo operativo de Opus 5.5 aproximadamente un 40 % por debajo de Opus 5 para una carga de trabajo típica facturada por token, según su propia estimación.
Seis meses de datos de uso de Claude Code
La publicación, escrita por Michael Segner, se basa en datos de uso agregados que abarcan de marzo a septiembre de 2026. El número de prompts por sesión se mantuvo estable, según informa la publicación, mientras que el trabajo dentro de cada prompt aumentó: el modelo ahora trabaja 3,3 veces más tiempo por prompt y realiza más de un 40 % más de llamadas al modelo en cada uno, y las interrupciones disminuyeron un 68 %. Los desarrolladores ahora conectan un servidor de herramientas o utilizan una habilidad aproximadamente el doble de veces, y pegan texto en los prompts un tercio menos de veces.
La cantidad de contexto en cada solicitud creció 2,6 veces durante el período, y la proporción de tokens de entrada a salida pasó de 189:1 a 324:1. Anthropic interpreta estos números como que los desarrolladores buscan un modelo que trabaje más tiempo y esté mejor informado para tareas más grandes y abiertas, y afirma que el ahorro de Opus 5.5 es mayor precisamente en esas sesiones más largas y con mayor contexto cuando el uso se factura por token.
El análisis se basa en el lanzamiento de Claude Opus 5.5 por parte de Anthropic, que llegó con precios más bajos que Opus 5. Mientras el lanzamiento estableció los precios, la publicación del 24 de septiembre y un análisis complementario publicado el 22 de septiembre de 2026 por Addy Osmani examinan lo que esos precios significan para cargas de trabajo reales de Claude Code.
Precios de tokens y la reducción de lecturas de caché
Para el uso facturado por token, Anthropic redujo los precios de los tokens de entrada y salida en un 20 % y recortó el precio de leer un token en caché en un 60 %. La empresa afirma que la reducción de lecturas de caché tiene mayor peso porque las lecturas de caché representan la mayor parte del costo del trabajo agente y de codificación, y señala que, al momento de la publicación, un token en caché en Opus 5.5 cuesta una quinta parte del de los modelos competidores y los supera.
El análisis complementario de Osmani enumera los precios de lista de la API de Opus 5.5 en $4 por millón de tokens de entrada, $20 por millón de tokens de salida y $0,20 por millón de lecturas de caché. Con esos precios, una lectura en caché cuesta el 5 % de un token de entrada nuevo, mientras que escribir en la caché cuesta 1,25 veces el precio de entrada para una caché de cinco minutos y el doble del precio de entrada para una caché de una hora, con cada acceso renovando la duración de forma gratuita. En los planes Pro, Max o Team, el precio más bajo de Opus 5.5 se traslada a los límites del plan, de modo que alcanzan aproximadamente un 25 % más que en Opus 5; el descuento adicional en lecturas de caché se aplica solo a la facturación de la API.
Aprovechar los cambios que protegen la caché
Incluso cuando el contexto por solicitud aumentó aproximadamente 2,6 veces, la proporción de entrada que no utiliza la caché disminuyó más del 50 % durante el período de seis meses, informa la publicación. Atribuye esto a una serie de cambios en Claude Code que reducen rupturas accidentales de la caché, abarcando pequeñas interrupciones como una actualización de inicio de sesión y mayores como la incorporación de instrucciones a mitad de la conversación o la carga de herramientas bajo demanda. En Opus 5.5 y Fable 5.1, los desarrolladores también pueden cambiar los niveles de esfuerzo a mitad de sesión sin restablecer la caché.
La documentación de almacenamiento en caché de prompts oficial especifica que el comportamiento de nivel de esfuerzo se aplica con una clave API o una suscripción a Claude, y no en Amazon Bedrock, la Plataforma de Agentes de Google Cloud, ni en una puerta de enlace de aplicaciones Claude, ni cuando la bandera CLAUDECODEDISABLEEXPERIMENTALBETAS está activada o una organización tiene una configuración HIPAA.
Los desarrolladores con claves API y proveedores de nube ahora pueden establecer una vida útil de caché de una hora, que los suscriptores ya tenían. La documentación muestra los valores predeterminados: una hora para la conversación principal en una suscripción a Claude dentro del uso del plan, y cinco minutos para créditos de uso, claves API o proveedores de nube. La configuración promptCacheTtl o la variable de entorno CLAUDECODEPROMPTCACHETTL selecciona la vida útil más larga, y ambos controles requieren Claude Code v2.1.242 o posterior.
Los subagentes bifurcados ahora comienzan desde la caché de la sesión principal en lugar de pagar por reprocesar el mismo contexto. La documentación explica que una bifurcación asume el prompt del sistema del padre, el conjunto de herramientas y todo el historial de la conversación, de modo que su solicitud inicial lee directamente de la caché del padre.
Menos turnos por tarea
Anthropic informa que Opus 5.5 puede completar una tarea en menos turnos que otros modelos. Según la publicación, Zeta Labs registró menos turnos y llamadas a herramientas por tarea que en Opus 5, a casi la mitad del costo, y finalizó el doble de sus tareas más difíciles.
La publicación advierte que el patrón no se mantendrá en todas las tareas, citando análisis de Osmani: “En una tarea bien delimitada, ambos modelos terminan con aproximadamente el mismo número de turnos, y la reducción de precio es todo lo que obtienes. La brecha debería ser mayor en tareas abiertas, donde un modelo puede gastar muchos turnos en la idea equivocada.”
Anthropic también informa que Opus 5.5 genera resultados más de un 30 % más rápido que Opus 5. El beneficio mantiene sin cambios el uso de tokens y la tasa de aciertos en caché; la publicación señala que acorta la espera en ejecuciones largas ya que Claude pasa más tiempo trabajando sin supervisión.
El artículo cierra con prácticas para proteger lecturas en caché: ejecute /usage en Claude Code para ver qué proporción de una sesión se sirve desde la caché, elija el modelo al iniciar una sesión en lugar de cambiarlo a mitad de camino, ejecute la compactación antes de alejarse en lugar de después, y en una clave API o proveedor de nube, habilite la duración de caché de una hora para sesiones largas.












