Cybersécurité

Anthropic élargit le Programme de vérification cyber à trois niveaux d’accès

mm
Ajouter Unite.AI à vos sources préférées sur Google

Anthropic le 6 octobre 2026 a annoncé un Programme de vérification cyber élargi qui rend les capacités cyber avancées et les classificateurs à blocage réduit disponibles pour les professionnels de la sécurité qualifiés à travers trois niveaux d’accès. Chaque niveau comprend l’accès à Claude Opus 5.5, Claude Sonnet 5.5, Claude Mythos 5.1, ainsi que les nouveaux modèles à venir.

Anthropic a décrit la cybersécurité comme intrinsèquement à double usage, affirmant que les mêmes capacités qui permettent à une équipe de sécurité de détecter et corriger une vulnérabilité peuvent également aider un acteur malveillant à l’exploiter. L’entreprise a indiqué que ses modèles généralement disponibles, y compris Claude Opus 5.5, Claude Fable 5.1 et Claude Sonnet 5.5, intègrent des garde-fous cyber conservateurs qui bloquent la plupart des travaux cyber, une approche qu’elle dit destinée à limiter les activités nuisibles des acteurs malveillants tout en travaillant à réduire les faux positifs pour le codage sécurisé.

Pendant les six mois précédant l’annonce, Anthropic a fourni un accès de confiance via deux programmes : Project Glasswing, qui offrait aux organisations assurant des logiciels critiques l’accès à Claude Mythos, et le Programme de vérification cyber original, qui accordait aux équipes de sécurité vérifiées des garde-fous réduits sur les modèles Claude Opus et Claude Sonnet. Les deux programmes sont désormais intégrés dans l’offre élargie unique. Anthropic a indiqué que ses modèles généralement disponibles restent utilisables par tous les utilisateurs pour des tâches telles que la révision de code, la correction de problèmes connus, la recherche de vulnérabilités dans le code source détenu, et le tri des alertes de sécurité.

Accès Défense, Équipe rouge et Spécialisé

L’Accès Défense couvre les travaux défensifs, y compris les tâches du centre des opérations de sécurité et de réponse aux incidents, le rétro‑ingénierie de logiciels malveillants, ainsi que l’analyse et la validation des vulnérabilités. Des exemples d’organisations éligibles comprennent les équipes de sécurité d’entreprises, d’organisations à but non lucratif, d’universités et d’organismes gouvernementaux qui défendent des systèmes qu’ils possèdent ou maintiennent ; les opérateurs d’infrastructures critiques de toute taille, tels que les hôpitaux régionaux ou les services publics municipaux ; les petites sociétés de sécurité ; les mainteneurs de projets open source ; et les chercheurs individuels ayant un historique de vulnérabilités signalées. Anthropic a indiqué qu’elle s’attend à ce que de nombreuses organisations menant des travaux de cybersécurité défensive se qualifient pour ce niveau, et qu’elle vise à répondre aux demandes en quelques jours.

L’Accès Équipe rouge ajoute des tests d’intrusion autorisés et des exercices de red‑team contre les systèmes qu’une organisation est autorisée à tester, y compris les systèmes informatiques des industries critiques. Des exemples d’organisations éligibles comprennent les équipes rouges internes, les équipes rouges gouvernementales et les sociétés de sécurité et de tests d’intrusion. Les utilisateurs de ce niveau font encore face à des blocages en temps réel sur des actions susceptibles de causer des dommages physiques ou une perturbation massive, telles que le déploiement de ransomware, la détérioration de systèmes physiques ou les tests d’intrusion de systèmes de sécurité à haut risque. Anthropic a indiqué qu’elle s’attend à ce que les demandes à ce niveau prennent quelques semaines à être examinées, inscrit les organisations éligibles dans l’Accès Défense pendant que leurs demandes d’Accès Équipe rouge sont examinées, et limite ce niveau aux organisations.

L’Accès spécialisé comporte le moins de blocages cyber et est réservé à un ensemble limité d’organisations vérifiées autorisées à tester des systèmes de sécurité pouvant affecter la vie des personnes ou perturber les marchés, tels que les systèmes d’exploitation de vols, les réseaux électriques, les réseaux de télécommunications, les infrastructures de transfert interbancaire et les réseaux administratifs gouvernementaux. Anthropic examine actuellement chaque organisation à ce niveau en profondeur en collaboration avec le gouvernement américain, et les membres existants de Project Glasswing passent à ce niveau sans nécessiter de nouvelle approbation pour les modèles actuels.

Selon la page du Centre d’aide Claude du programme, les individus ne peuvent postuler que pour l’Accès Défense et doivent être sur un abonnement payant, tandis que l’Accès Équipe rouge et l’Accès spécialisé sont réservés aux organisations uniquement. Chaque organisation soumet une demande unique, et Anthropic place le demandeur au niveau le plus élevé soutenu par les informations reçues, visant à envoyer une décision ou une demande d’informations complémentaires dans les sept jours ouvrables. Dans le cadre du processus, Anthropic vérifie tous les candidats et demande une preuve des contrôles de sécurité requis pour le niveau concerné. Le Centre d’aide indique que l’éligibilité reflète des facteurs tels que la nature du travail de l’organisation, la capacité d’Anthropic à vérifier son identité, le cadre juridique et réglementaire dans lequel elle opère, le risque de détournement ou d’accès forcé, et le destinataire final du travail, avec une approche plus prudente lorsqu’une organisation sert principalement des clients militaires, de renseignement ou d’application de la loi.

Tests de garde-fous sur CyScenarioBench

Pour évaluer l’efficacité des protections du programme, Anthropic a soumis Claude Opus 5.5 à CyScenarioBench, une évaluation qu’elle a décrite comme mesurant la capacité des modèles à planifier et exécuter des opérations cyber à plusieurs étapes sous des contraintes réalistes, avec des garde-fous ajustés aux différents niveaux du CVP. Les tests ont couvert cinq tentatives pour chacun des 10 défis dans chaque niveau d’accès.

Anthropic a indiqué que sans accès CVP, chaque tâche était bloquée dès la première invite. Dans le niveau d’accès Defense Access, 46 des 50 essais ont été bloqués à un moment donné du défi, tandis que les quatre tâches restantes ont réussi. Dans le niveau d’accès Red Team Access, aucun blocage n’est survenu et Claude Opus 5.5 a réussi à accomplir 34 des 50 tâches, ce qu’Anthropic a décrit comme étant effectivement équivalent au taux de réussite de 67,6 % du modèle sur l’évaluation sans aucune mesure de sécurité appliquée, un résultat qu’elle a déclaré représentatif de l’accès Specialized Access. L’entreprise a affirmé que ces évaluations lui donnent confiance que des capacités cyber avancées peuvent être mises à disposition en toute sécurité d’un plus grand nombre de défenseurs, et qu’elle continuera à affiner ses classificateurs basés sur les niveaux au fil du temps.

Chiffres de vulnérabilités signalés du projet Glasswing

Anthropic a indiqué que les partenaires de Glasswing avaient découvert au moins 129 000 vulnérabilités logicielles vérifiées entre avril et juillet 2026, et que ses propres efforts de scan open source avaient trouvé 5 500 vulnérabilités logicielles vérifiées supplémentaires entre avril et octobre 2026. Plus de 33 000 de ces vulnérabilités vérifiées ont jusqu’à présent été classées comme critiques ou de haute gravité, a déclaré l’entreprise.

L’entreprise a décrit ces chiffres comme probablement sous‑estimés, notant qu’ils proviennent de données d’enquête provenant uniquement d’un sous‑ensemble des partenaires de Glasswing, soit 33 rapports de partenaires au total, et a indiqué s’attendre à ce que l’impact réel soit au moins cinq fois plus élevé. Anthropic a précisé que les organisations adoptaient des approches différentes pour le triage, et que moins de 50 % des partenaires ont divulgué les nombres de correctifs, souvent parce que leurs correctifs étaient encore en cours, ce qui fait que le taux de correctifs est largement sous‑décompté.

Lorsqu’on leur a demandé combien de temps il aurait fallu pour découvrir le même nombre de vulnérabilités sans les modèles Claude Mythos, plusieurs partenaires ont indiqué à Anthropic que les modèles avaient augmenté leur rythme de découverte de vulnérabilités de plusieurs mois, voire années. L’entreprise a fait référence à des comptes rendus publiés par les partenaires Booz Allen et Comcast concernant leur expérience.

Rétention des données, disponibilité et détails de l’application

La rétention des données est requise pour les organisations inscrites au programme afin qu’Anthropic puisse surveiller les usages cybermalveillants. Une fois que Enterprise Frontier Safeguards, une solution qu’Anthropic décrit comme combinant la confidentialité d’une rétention zéro des données avec des mesures de sécurité robustes, sera disponible à l’automne 2026, les organisations éligibles pourront stocker les données dans l’infrastructure cloud qu’elles contrôlent. D’ici là, les organisations disposant d’un accès à zéro rétention de données à Claude Fable 5.1 or Claude Mythos 5.1 peuvent également utiliser le CVP avec zéro rétention de données.

Le CVP est disponible sur la Claude Platform, Vertex AI de Google Cloud et Microsoft Foundry. Sur Amazon Bedrock, il n’est disponible que pour les clients éligibles à Enterprise Frontier Safeguards ; le Centre d’aide indique qu’Amazon Bedrock ne prend pas encore en charge la révision humaine des drapeaux de sécurité automatisés, ce que le CVP exige par défaut, et qu’Anthropic travaille à étendre le CVP à tous les clients sur Bedrock. Les plateformes tierces, telles que les outils de codage, ne prennent en charge que Defense Access et Red Team Access ; Specialized Access n’est pas disponible via ces plateformes.

Les organisations déjà inscrites au projet Glasswing ou au CVP n’ont pas besoin de postuler à nouveau ; leur accès existant continue de fonctionner selon leurs conditions actuelles, et elles seront transférées vers le nouveau niveau pertinent pour Claude Opus 5.5, Claude Sonnet 5.5 et Claude Mythos 5.1. La politique d’utilisation d’Anthropic continue de s’appliquer intégralement, et le Centre d’aide indique que l’entreprise peut réexaminer, restreindre ou retirer une subvention. La création d’un produit destiné aux clients basé sur ces capacités est régie séparément par la politique de cyber‑productisation d’Anthropic, avec une demande de productisation qui sera mise à disposition des utilisateurs du CVP.

Les organisations disposant de l’accès Defense Access ont jusqu’au 15 décembre 2026 pour adopter une authentification multifacteur résistante au phishing et cesser d’utiliser les clés API ; d’ici là, une forme d’authentification multifacteur est requise et les clés API expirent tous les sept jours. L’accès à Mythos sur les fournisseurs cloud tiers suit l’approbation de la demande avec un délai d’environ cinq jours ouvrables. Anthropic a programmé un webinaire sur le programme le 14 octobre 2026 à 9 h, heure du Pacifique.

Miles Okada est un agent de recherche généré par IA chez Unite.AI, couvrant l'intelligence artificielle et la cybersécurité avec un accent sur les menaces émergentes, les architectures défensives et la dynamique évolutive entre les attaquants et les systèmes automatisés. Son travail examine comment l'IA transforme les opérations de sécurité, de la détection et de la réponse autonomes à l'essor des techniques d'IA adversaire.

Avec une perspective technique et investigative, Miles analyse les recherches en sécurité, les divulgations d'incidents et les déploiements réels afin de comprendre où l'IA renforce les défenses — et où elle introduit de nouvelles vulnérabilités. Il porte une attention particulière à l'exploitation des modèles, au poisonnement des données, à l'automatisation des attaques et aux réalités opérationnelles de la sécurisation à grande échelle des systèmes alimentés par l'IA.

Les articles rédigés par Miles Okada sont générés par IA et révisés par l'équipe éditoriale de Unite.AI afin d'assurer précision, rigueur et couverture responsable du paysage de la sécurité de l'IA en évolution rapide.