Modèles et plateformes d’IA

Claude Fable 5 rend l’intelligence artificielle de pointe une utilité à la demande

mm
Ajouter Unite.AI à vos sources préférées sur Google

Claude Fable 5 est sorti, et l’histoire de la capacité est authentique. Stripe a rapporté l’utiliser pour exécuter une migration à l’échelle du codebase sur 50 millions de lignes de code en une seule journée — deux mois de travail d’une équipe, compressés en un. Anthropic affirme qu’il peut fonctionner pendant des jours à l’intérieur d’un harnais d’agent sans surveillance humaine. Si vous effectuez des travaux à long terme, à hauts enjeux, c’est le modèle que vous utilisez lorsque le travail est vraiment difficile.

Mais la partie du lancement d’aujourd’hui qui change la façon dont un opérateur planifie n’est pas la capacité. Ce sont les trois choses qu’Anthropic y a attachées : le prix, le lancement et la politique de données. Ensemble, ils marquent la fin de la phase tout-inclus de l’intelligence artificielle de pointe.

Le forfait haut de gamme à tarif fixe est dégroupé

Fable 5 coûte 10 $ par million de jetons d’entrée et 50 $ par million de jetons de sortie. C’est le double du tarif standard de Opus 4.8 , et il atterrit exactement au prix du mode rapide d’Opus 4.8. Le haut de la gamme coûte maintenant de l’argent réel par jeton, et ce avant de tenir compte du nombre de jetons qu’une exécution agente de plusieurs jours brûle réellement.

Le lancement rend le changement explicite. Jusqu’au 22 juin 2026, Fable 5 est inclus dans les plans Pro, Max, Team et les plans d’entreprise basés sur les sièges sans frais supplémentaires. Le 23 juin, Anthropic le retire de ces plans — après cela, l’utilisation de Fable 5 fonctionne avec des crédits d’utilisation, et ils le rétabliront plus tard dans les abonnements « lorsqu’ils le pourront ». Sur les plans d’API et les plans d’entreprise basés sur la consommation, il est entièrement mesuré dès le premier jour.

Lisez ce lancement pour ce qu’il est. Le modèle le plus capable est trop coûteux pour être calculé et trop demandé pour être offert à l’intérieur d’un siège mensuel plat, il est donc facturé comme une ressource mesurée. Vos 20 ou 200 $ par mois vous achètent les niveaux standard. La frontière est un robinet avec un compteur maintenant, et le compteur est le point.

Ceci n’est pas une plainte concernant les marges d’Anthropic. Ils paient apparemment plus d’un milliard de dollars par mois pour la capacité des centres de données et courent la même course de calcul que tout le monde ; l’économie est ce qu’elle est. Mais « le meilleur modèle est inclus dans mon plan » était un réel postulat de fonctionnement pour beaucoup de gens, et à partir du 23 juin, il cesse d’être vrai au sommet.

La décision de hiérarchisation des modèles est maintenant une ligne budgétaire

Voici où cela devient pratique. Le mouvement réflexe lorsqu’un nouveau modèle de pointe atterrit est de pointer tout vers lui. Avec la tarification mesurée de la frontière, ce réflexe est la façon dont vous brûlez un budget.

Hiérarchisez le travail à la place. La plupart de ce qu’une opération exécute — la rédaction, la synthèse, le code de routine, les cent petites appels qui composent un véritable pipeline — n’a pas besoin d’un modèle de la classe Mythos. Exécutez-le sur Sonnet ou Opus, où il a toujours fonctionné correctement. Réservez Fable 5 pour les travaux qui en ont vraiment besoin : la migration à long terme, l’exécution de recherche de plusieurs jours, le problème où un modèle plus faible stagne et où le modèle prime paye réellement pour lui-même. La migration de Stripe est exactement de cette forme — deux mois en un jour valent 50 $ par million tout au long de la journée.

C’est toute la discipline. Faites correspondre le modèle au travail, et le prix cesse d’être effrayant parce que vous ne payez les tarifs de la frontière que sur les tours où la capacité de la frontière change le résultat.

Lisez la politique de rétention avant de transmettre des données client à travers

Le troisième changement est celui qui est le plus susceptible de mordre discrètement. Anthropic modifie la façon dont il gère les données des clients commerciaux sur ces modèles : il exige maintenant une rétention des données de 30 jours sur tout le trafic vers les modèles de la classe Mythos — Fable 5, Mythos 5 et tout ce qui suit ce niveau de capacité à l’avenir — sur les surfaces de première et de troisième partie.

Ces « modèles couverts » ne sont pas disponibles sous une rétention de données nulle, il n’y a donc pas d’opt-out effectif. Anthropic n’utilisera pas les données pour la formation ou les utilisera à des fins autres que la sécurité, il consigne tous les accès humains et supprime les données après 30 jours dans presque tous les cas. Le raisonnement est défendable : un modèle aussi capable est une cible, et les données conservées sont la façon dont ils attrapent les jailbreaks et les attaques à plusieurs requêtes novatrices.

Mais « nous conservons tout pendant 30 jours, sans opt-out » est un fait de gouvernance, et non une note de bas de page. Si vous exécutez des travaux de clients, des matériaux confidentiels ou tout ce qui est soumis à un contrat qui a promis une rétention nulle, cette promesse et cette politique entrent maintenant en collision. Quiconque construit des agents qui doivent satisfaire aux règles de gouvernance des données réelles doit équilibrer cela avant de transmettre un seul jeton sensible via Fable 5. Pour certaines charges de travail, la réponse honnête sera : conservez ce pipeline sur un modèle avec une politique de rétention que vous pouvez réellement respecter, et réservez Fable pour les travaux où cela convient.

Le véritable changement

Enlevez les victoires de benchmark et aujourd’hui est un événement de tarification et de politique autant que de capacité. Le modèle de pointe est plus capable que tout ce que vous pouviez obtenir auparavant, plus coûteux à exécuter, mesuré au lieu d’être inclus, et il conserve vos données pendant un mois que vous le vouliez ou non.

C’est un type différent de transaction — la capacité de pointe en tant qu’outil mesuré que vous utilisez délibérément, et non un robinet que vous laissez ouvert parce qu’il est venu avec le plan.

Les opérateurs qui internalisent cela tôt obtiendront les gains de plusieurs mois en une journée sans la facture surprise. Ceux qui pointent tout vers le niveau le plus élevé par réflexe sont sur le point d’apprendre ce que cela coûte.

Alex McFarland est un journaliste et écrivain en intelligence artificielle qui explore les derniers développements en intelligence artificielle. Il a collaboré avec de nombreuses startups et publications en intelligence artificielle dans le monde entier.