Modelos y plataformas de IA

El Opus 5 de Anthropic se acerca a la inteligencia de frontera a precios de Opus

mm
AÃąade Unite.AI a tus fuentes preferidas en Google
A person at a desk at night reading a long streaming reply in a warm-toned AI assistant chat interface, with a two-bar capability-versus-cost chart glowing on a second screen.

Anthropic lanzÃģ Claude Opus 5 el 24 de julio de 2026, presentando su nuevo modelo Opus-class como un caballo de batalla diario que, segÚn la propia cuenta de la empresa, se acerca a la inteligencia de su modelo de frontera mÃĄs caro, Fable 5, a la mitad del costo. Opus 5 estÃĄ disponible de inmediato en todas las aplicaciones de Anthropic, su API y las principales plataformas en la nube, a $5 por millÃģn de tokens de entrada y $25 por millÃģn de tokens de salida, las mismas tarifas que el modelo que reemplaza, Opus 4.8.

El lanzamiento convierte a Opus 5 en el modelo predeterminado en la suscripciÃģn Max de Anthropic y en la opciÃģn mÃĄs fuerte disponible en Pro. La empresa lo presenta mÃĄs como un modelo ajustado para el uso diario que como un techo de capacidad, con un ajuste de esfuerzo que permite a los desarrolladores intercambiar la profundidad de razonamiento por un costo de token mÃĄs bajo y respuestas mÃĄs rÃĄpidas.

QuÃĐ muestran las pruebas de Anthropic

En sus propias evaluaciones de codificaciÃģn y trabajo de conocimiento, Anthropic informa que Opus 5 es de Última generaciÃģn en pruebas que incluyen Frontier-Bench y GDPval-AA, mientras se queda atrÃĄs de su modelo Mythos 5 restringido en tareas de ciberseguridad. La empresa dice que Opus 5 mÃĄs que duplica la puntuaciÃģn de Opus 4.8 en Frontier-Bench a un costo mÃĄs bajo por tarea, aterriza dentro del 0,5% del pico de Fable 5 en la evaluaciÃģn de codificaciÃģn CursorBench con el esfuerzo mÃĄximo mientras cuesta la mitad que Fable 5 por tarea, y triplica el resultado del siguiente mejor modelo en ARC-AGI 3, una prueba construida alrededor de problemas nuevos que el modelo no ha visto. En la prueba de uso de computadora OSWorld, dice que Opus 5 supera el mejor resultado de Fable 5 a poco mÃĄs de un tercio del costo.

Anthropic enmarca el salto como una cuestiÃģn de juicio en lugar de puntuaciones brutales. Describe una prueba en la que Opus 5 recibiÃģ un dibujo de una parte de la mÃĄquina pero no tenía forma de ver la imagen; el modelo escribiÃģ su propia tubería de visiÃģn por computadora para extraer la geometría de los píxeles brutos y reconstruir la parte, una tarea que la empresa dice que ningÚn modelo competidor resolviÃģ en cinco intentos.

Esas son cifras informadas por el proveedor, ejecutadas en los arneses de Anthropic, y ninguna ha sido replicada de forma independiente hasta ahora. Esa distinciÃģn importa mÃĄs que lo habitual aquí, porque el reclamo de titular no es que Opus 5 encabece una clasificaciÃģn, sino que entrega resultados adyacentes a la frontera a un precio de nivel medio. La Única comprobaciÃģn externa que Anthropic revela es la prueba de rango cibernÃĐtico de puntos de control tempranos de Opus 5 por el Instituto de Seguridad de Inteligencia Artificial del Reino Unido, informado en la tarjeta del sistema del modelo.

Rellenando un vacío en la alineaciÃģn

El lanzamiento tapa un agujero que Anthropic había abierto en su propia alineaciÃģn de 2026. Sonnet 5, lanzado el 30 de junio de 2026, entregÃģ cerca del trabajo de nivel Opus a una fracciÃģn del precio, mientras que el modelo Mythos-class Fable 5, lanzado el 9 de junio de 2026, se sentÃģ por encima de Opus al doble del costo. Eso dejÃģ al nivel Opus aplastado por ambos lados. Opus 5 da a los clientes Max, Team y Enterprise una opciÃģn adyacente a la frontera sin pagar las tarifas de Fable o Mythos.

Para los equipos que ejecutan cargas de trabajo de agentes a largo plazo, el costo por tarea completada tiende a importar mÃĄs que el precio de etiqueta por token, y Anthropic se apoya en esa matemÃĄtica. Dice que Opus 5 termina el trabajo en menos pasos y con menos llamadas de herramientas que Opus 4.8, y ofrece un modo RÃĄpido que ejecuta alrededor de 2,5 veces la velocidad predeterminada al doble del precio base.

Seguridad y las salvedades en la tarjeta del sistema

La tarjeta del sistema de Anthropic llama a Opus 5 su modelo mÃĄs alineado hasta la fecha en la auditoría de comportamiento automatizada de la empresa, anotando por delante de Sonnet 5, Opus 4.8 y el modelo de nivel de frontera Fable 5 en adherencia a su constituciÃģn del modelo, con la tasa mÃĄs baja de cooperaciÃģn con el mal uso de cualquier modelo que haya probado. Esas son autoevaluaciones de la auditoría interna de Anthropic, no hallazgos externos.

El mismo documento es inusualmente franco sobre los límites del modelo. Observa que Opus 5 “alucina afirmaciones fÃĄcticas ligeramente mÃĄs que Opus 4.8, a pesar de ser mÃĄs preciso en general”, y que se queda atrÃĄs de Mythos 5 en investigaciÃģn biolÃģgica y ciberseguridad ofensiva. En un ejercicio interno de biología, el modelo se quedÃģ atascado repetidamente en bucles de autoverificaciÃģn y no pudo entregar un conjunto de diseÃąos de proteínas que Mythos 5 completÃģ.

En cuanto a las salvaguardias cibernÃĐticas, Anthropic modelÃģ los clasificadores de Opus 5 en los de Fable 5 pero espera que intervengan alrededor de un 85% menos. El modelo ahora estÃĄ permitido para buscar vulnerabilidades en el cÃģdigo fuente, un trabajo que se inclina hacia la defensa, mientras que el escaneo de binarios compilados, las pruebas de penetraciÃģn y la generaciÃģn de exploits siguen bloqueados. Las solicitudes que activan un clasificador caen de forma predeterminada en Opus 4.8. A diferencia de Fable y Mythos, Opus 5 no lleva un requisito de retenciÃģn de datos para el acceso general.

La prueba prÃĄctica ahora es si los evaluadores independientes reproducen las ganancias de codificaciÃģn y razonamiento que Anthropic estÃĄ informando, y si las mejoras de alineaciÃģn se mantienen fuera de la auditoría de la propia empresa. Hasta entonces, lo mÃĄs claro que Opus 5 cambia es el precio de la capacidad cercana a la frontera en el propio catÃĄlogo de Anthropic.

Jonas Reeve es un analista generado por IA en Unite.AI, centrado en la inteligencia artificial cognitiva, la inteligencia artificial general (AGI) y los fundamentos teÃģricos de la inteligencia de la mÃĄquina. Su trabajo explora cÃģmo surgen el aprendizaje, el razonamiento, la memoria y la abstracciÃģn en sistemas biolÃģgicos y artificiales, estableciendo conexiones entre las arquitecturas de IA modernas y las preguntas largamente debatidas en la ciencia cognitiva y la filosofía de la mente.
Con un enfoque conceptual y reflexivo, Jonas examina marcos como los modelos de razonamiento, los sistemas agÃĐnticos, la cogniciÃģn emergente y la teoría de alineaciÃģn, con el objetivo de aclarar quÃĐ significa realmente el progreso hacia la AGI —y quÃĐ no. En lugar de perseguir cronogramas o publicidad, enfatiza los primeros principios, la rigidez conceptual y los límites de los modelos actuales.
Los artículos escritos por Jonas Reeve son generados por IA y revisados por el equipo editorial de Unite.AI para garantizar la precisiÃģn, la claridad y la discusiÃģn responsable de conceptos de IA avanzados.