Modelos y plataformas de IA
El Opus 5 de Anthropic se acerca a la inteligencia de frontera a precios de Opus

Anthropic lanzó Claude Opus 5 el 24 de julio de 2026, presentando su nuevo modelo Opus-class como un caballo de batalla diario que, según la propia cuenta de la empresa, se acerca a la inteligencia de su modelo de frontera más caro, Fable 5, a la mitad del costo. Opus 5 está disponible de inmediato en todas las aplicaciones de Anthropic, su API y las principales plataformas en la nube, a $5 por millón de tokens de entrada y $25 por millón de tokens de salida, las mismas tarifas que el modelo que reemplaza, Opus 4.8.
El lanzamiento convierte a Opus 5 en el modelo predeterminado en la suscripción Max de Anthropic y en la opción más fuerte disponible en Pro. La empresa lo presenta más como un modelo ajustado para el uso diario que como un techo de capacidad, con un ajuste de esfuerzo que permite a los desarrolladores intercambiar la profundidad de razonamiento por un costo de token más bajo y respuestas más rápidas.
Qué muestran las pruebas de Anthropic
En sus propias evaluaciones de codificación y trabajo de conocimiento, Anthropic informa que Opus 5 es de última generación en pruebas que incluyen Frontier-Bench y GDPval-AA, mientras se queda atrás de su modelo Mythos 5 restringido en tareas de ciberseguridad. La empresa dice que Opus 5 más que duplica la puntuación de Opus 4.8 en Frontier-Bench a un costo más bajo por tarea, aterriza dentro del 0,5% del pico de Fable 5 en la evaluación de codificación CursorBench con el esfuerzo máximo mientras cuesta la mitad que Fable 5 por tarea, y triplica el resultado del siguiente mejor modelo en ARC-AGI 3, una prueba construida alrededor de problemas nuevos que el modelo no ha visto. En la prueba de uso de computadora OSWorld, dice que Opus 5 supera el mejor resultado de Fable 5 a poco más de un tercio del costo.
Anthropic enmarca el salto como una cuestión de juicio en lugar de puntuaciones brutales. Describe una prueba en la que Opus 5 recibió un dibujo de una parte de la máquina pero no tenía forma de ver la imagen; el modelo escribió su propia tubería de visión por computadora para extraer la geometría de los píxeles brutos y reconstruir la parte, una tarea que la empresa dice que ningún modelo competidor resolvió en cinco intentos.
Esas son cifras informadas por el proveedor, ejecutadas en los arneses de Anthropic, y ninguna ha sido replicada de forma independiente hasta ahora. Esa distinción importa más que lo habitual aquí, porque el reclamo de titular no es que Opus 5 encabece una clasificación, sino que entrega resultados adyacentes a la frontera a un precio de nivel medio. La única comprobación externa que Anthropic revela es la prueba de rango cibernético de puntos de control tempranos de Opus 5 por el Instituto de Seguridad de Inteligencia Artificial del Reino Unido, informado en la tarjeta del sistema del modelo.
Rellenando un vacío en la alineación
El lanzamiento tapa un agujero que Anthropic había abierto en su propia alineación de 2026. Sonnet 5, lanzado el 30 de junio de 2026, entregó cerca del trabajo de nivel Opus a una fracción del precio, mientras que el modelo Mythos-class Fable 5, lanzado el 9 de junio de 2026, se sentó por encima de Opus al doble del costo. Eso dejó al nivel Opus aplastado por ambos lados. Opus 5 da a los clientes Max, Team y Enterprise una opción adyacente a la frontera sin pagar las tarifas de Fable o Mythos.
Para los equipos que ejecutan cargas de trabajo de agentes a largo plazo, el costo por tarea completada tiende a importar más que el precio de etiqueta por token, y Anthropic se apoya en esa matemática. Dice que Opus 5 termina el trabajo en menos pasos y con menos llamadas de herramientas que Opus 4.8, y ofrece un modo Rápido que ejecuta alrededor de 2,5 veces la velocidad predeterminada al doble del precio base.
Seguridad y las salvedades en la tarjeta del sistema
La tarjeta del sistema de Anthropic llama a Opus 5 su modelo más alineado hasta la fecha en la auditoría de comportamiento automatizada de la empresa, anotando por delante de Sonnet 5, Opus 4.8 y el modelo de nivel de frontera Fable 5 en adherencia a su constitución del modelo, con la tasa más baja de cooperación con el mal uso de cualquier modelo que haya probado. Esas son autoevaluaciones de la auditoría interna de Anthropic, no hallazgos externos.
El mismo documento es inusualmente franco sobre los límites del modelo. Observa que Opus 5 “alucina afirmaciones fácticas ligeramente más que Opus 4.8, a pesar de ser más preciso en general”, y que se queda atrás de Mythos 5 en investigación biológica y ciberseguridad ofensiva. En un ejercicio interno de biología, el modelo se quedó atascado repetidamente en bucles de autoverificación y no pudo entregar un conjunto de diseños de proteínas que Mythos 5 completó.
En cuanto a las salvaguardias cibernéticas, Anthropic modeló los clasificadores de Opus 5 en los de Fable 5 pero espera que intervengan alrededor de un 85% menos. El modelo ahora está permitido para buscar vulnerabilidades en el código fuente, un trabajo que se inclina hacia la defensa, mientras que el escaneo de binarios compilados, las pruebas de penetración y la generación de exploits siguen bloqueados. Las solicitudes que activan un clasificador caen de forma predeterminada en Opus 4.8. A diferencia de Fable y Mythos, Opus 5 no lleva un requisito de retención de datos para el acceso general.
La prueba práctica ahora es si los evaluadores independientes reproducen las ganancias de codificación y razonamiento que Anthropic está informando, y si las mejoras de alineación se mantienen fuera de la auditoría de la propia empresa. Hasta entonces, lo más claro que Opus 5 cambia es el precio de la capacidad cercana a la frontera en el propio catálogo de Anthropic.












