Modèles et plateformes d’IA
Le modèle Opus 5 d’Anthropic approche l’intelligence de pointe à des prix Opus

Anthropic a publié Claude Opus 5 le 24 juillet 2026, présentant son nouveau modèle Opus comme un cheval de travail quotidien qui, selon les dires de l’entreprise, se rapproche de l’intelligence de son modèle frontalier plus coûteux, Fable 5, à moitié prix. Opus 5 est disponible immédiatement sur les applications d’Anthropic, son API et les principales plateformes cloud, à 5 $ par million de jetons d’entrée et 25 $ par million de jetons de sortie, les mêmes tarifs que le modèle qu’il remplace, Opus 4.8.
Le lancement fait d’Opus 5 le modèle par défaut sur l’abonnement Max d’Anthropic et l’option la plus puissante disponible sur Pro. L’entreprise le présente moins comme un plafond de capacité que comme un modèle conçu pour une utilisation quotidienne, avec un réglage d’effort qui permet aux développeurs d’échanger la profondeur de raisonnement pour un coût par jeton plus bas et des réponses plus rapides.
Ce que montrent les benchmarks d’Anthropic
Dans ses propres évaluations de codage et de travail de connaissance, Anthropic rapporte qu’Opus 5 est à la pointe de la technologie sur des tests tels que Frontier-Bench et GDPval-AA, tout en restant derrière son modèle Mythos 5 restreint sur les tâches de cybersécurité. L’entreprise déclare qu’Opus 5 double plus que le score d’Opus 4.8 sur Frontier-Bench à un coût inférieur par tâche, atterrit dans les 0,5 % du pic de Fable 5 sur l’évaluation de codage CursorBench à l’effort maximum tout en coûtant la moitié moins cher par tâche, et triple le résultat du modèle suivant sur ARC-AGI 3, un test conçu autour de problèmes nouveaux que le modèle n’a pas vus. Sur le benchmark d’utilisation d’ordinateur OSWorld, il affirme qu’Opus 5 bat le meilleur résultat de Fable 5 à un peu plus d’un tiers du coût.
Anthropic présente le saut comme une question de jugement plutôt que de scores bruts. Il décrit un test dans lequel Opus 5 a reçu un dessin d’une pièce de machine mais sans moyen de visualiser l’image ; le modèle a écrit son propre pipeline de vision par ordinateur pour extraire la géométrie des pixels bruts et reconstruire la pièce, une tâche que l’entreprise affirme qu’aucun modèle concurrent n’a résolue en cinq tentatives.
Ces chiffres sont rapportés par le fournisseur, exécutés sur les harnais d’Anthropic, et aucun n’a encore été reproduit de manière indépendante. Cette distinction compte plus que d’habitude ici, car l’affirmation principale n’est pas qu’Opus 5 domine un classement mais qu’il offre des résultats adjacents à la frontière à un prix de milieu de gamme. Le seul contrôle extérieur qu’Anthropic divulgue est le test de la gamme cybernétique des points de contrôle précoces d’Opus 5 par l’Institut de sécurité de l’IA du Royaume-Uni, rapporté dans la carte de système du modèle.
Remplir un vide dans la gamme
La sortie comble un vide que Anthropic avait ouvert dans sa propre gamme 2026. Sonnet 5, sorti le 30 juin 2026, a fourni un travail proche du niveau Opus à une fraction du prix, tandis que le modèle Mythos Fable 5, publié le 9 juin 2026, se situait au-dessus d’Opus à deux fois le coût. Cela a laissé le niveau Opus serré des deux côtés. Opus 5 donne aux clients Max, Team et Enterprise une option adjacente à la frontière sans payer les tarifs Fable ou Mythos.
Pour les équipes exécutant des charges de travail agentic à long terme, le coût par tâche terminée compte plus que le prix par jeton, et Anthropic s’appuie sur cette mathématique. Il affirme qu’Opus 5 termine les travaux en moins d’étapes et avec moins d’appels d’outils qu’Opus 4.8, et qu’il propose un mode rapide qui fonctionne environ 2,5 fois la vitesse par défaut au double du prix de base.
Sécurité, et les réserves dans la carte de système
La carte de système d’Anthropic qualifie Opus 5 de modèle le plus aligné à ce jour sur l’audit de comportement automatisé de l’entreprise, avec un score devant Sonnet 5, Opus 4.8 et le modèle frontalier Fable 5 en termes d’adhésion à sa constitution de modèle, avec le taux le plus bas de coopération avec les abus de tout modèle testé. Ce sont des auto-évaluations de l’audit interne d’Anthropic, et non des constats externes.
Le même document est inhabituellement franc sur les limites du modèle. Il note qu’Opus 5 « hallucine légèrement plus d’allégations factuelles qu’Opus 4.8, malgré une précision globale plus élevée », et qu’il traîne derrière Mythos 5 en recherche biologique et en cybersécurité offensive. Dans un exercice interne de biologie, le modèle s’est répétitivement bloqué dans des boucles d’auto-vérification et n’a pas fourni un ensemble de conceptions de protéines que Mythos 5 a terminées.
En matière de sauvegardes cybernétiques, Anthropic a modélisé les classificateurs d’Opus 5 sur ceux de Fable 5 mais s’attend à ce qu’ils interviennent environ 85 % moins souvent. Le modèle est maintenant autorisé à rechercher des vulnérabilités dans le code source, un travail qui penche vers la défense, tandis que le balayage des binaires compilés, les tests de pénétration et la génération d’exploits restent bloqués. Les demandes qui déclenchent un classificateur retombent par défaut sur Opus 4.8. Contrairement à Fable et Mythos, Opus 5 n’a pas d’exigence de rétention de données pour l’accès général.
Le test pratique est maintenant de savoir si les évaluateurs indépendants reproduisent les gains de codage et de raisonnement qu’Anthropic signale, et si les améliorations d’alignement tiennent debout en dehors de l’audit de l’entreprise. Jusqu’alors, la chose la plus claire que change Opus 5 est le prix de la capacité quasi-frontalière dans le catalogue d’Anthropic.












