Cybersécurité

Anthropic Expose la Première Cyberattaque à Grande Échelle Propulsée par l’Automatisation de l’IA

mm
Ajouter Unite.AI à vos sources préférées sur Google

Anthropic a révélé qu’un groupe de hackers, qu’ils soupçonnent d’être un groupe sponsorisé par l’État chinois, a mené la première cyberattaque documentée à grande échelle exécutée avec une intervention humaine minimale, en utilisant l’outil Claude Code de l’entreprise pour automatiser 80 à 90 pour cent de la campagne.

Les attaquants ont ciblé environ 30 organisations parmi les principales sociétés de technologie, les institutions financières, les fabricants de produits chimiques et les agences gouvernementales. Bien que la plupart des attaques aient été bloquées, la campagne a réussi dans un petit nombre de cas. Claude Code a effectué la reconnaissance, les tests de vulnérabilité, la collecte de mots de passe et l’exfiltration de données de manière largement autonome, avec des opérateurs humains nécessaires uniquement aux points de décision critiques.

<strong Vous pouvez lire le rapport complet d'Anthropic ici.

Méthodes d’attaque et manipulation de l’IA

Les hackers ont contourné les garde-fous de sécurité de Claude grâce à un ingénieux génie social. Ils ont trompé le système d’IA en prétendant être des employés d’une société de cybersécurité légitime effectuant des tests de défense. Les attaquants ont également décomposé leurs opérations en petites tâches apparemment innocentes qui ont fourni à Claude un contexte incomplet sur l’objectif global malveillant.

Claude Code a inspecté les systèmes des organisations ciblées pour identifier les bases de données à haute valeur, a effectué cette reconnaissance plus rapidement que les hackers humains ne l’auraient pu, et a recherché et écrit du code d’exploit personnalisé pour tester les vulnérabilités de sécurité. Le système a collecté des noms d’utilisateurs et des mots de passe pour un accès réseau ultérieur, puis a extrait et catégorisé les données privées en fonction de leur valeur d’information. Les attaquants ont pu exécuter la campagne avec essentiellement un clic de bouton, après quoi l’IA a fonctionné largement de manière autonome à des vitesses impossibles pour les équipes humaines – souvent en envoyant des milliers de requêtes par seconde.

Image: Anthropic

Détection et réponse de l’entreprise

Anthropic a détecté l’attaque à la mi-septembre 2025 et a lancé une enquête immédiatement. Dans les 10 jours, l’entreprise a fermé l’accès du groupe à Claude, a contacté les organisations touchées et a informé les forces de l’ordre. L’entreprise a depuis élargi ses capacités de détection et développe des méthodes supplémentaires pour enquêter et détecter les attaques distribuées à grande échelle.

Cet incident fait suite à des cas antérieurs de mauvaise utilisation documentés par Anthropic en 2025. En août, le rapport d’intelligence sur les menaces de l’entreprise a détaillé une opération d’extorsion de données suivie sous le nom de GTG-2002, qui a utilisé Claude Code pour commettre un vol à grande échelle ciblant au moins 17 organisations dans les soins de santé, les services d’urgence, le gouvernement et les institutions religieuses. Ce criminel a exigé des rançons dépassant 500 000 $ en menaçant d’exposer les données volées plutôt que d’utiliser un cryptage de rançon traditionnel.

L’infrastructure de détection d’Anthropic repose sur des techniques en couches multiples, notamment l’analyse du comportement pour surveiller les modèles d’utilisation sur des millions de requêtes API, la détection d’anomalies pour identifier les séquences d’opérations incohérentes avec une utilisation légitime, et la correspondance de modèles pour reconnaître les techniques de manipulation connues et nouvelles. L’entreprise emploie des classifyeurs spécialisés qui analysent les entrées utilisateur pour les requêtes potentiellement nuisibles et évaluent les réponses de Claude avant ou après leur livraison.

Implications pour l’industrie

La campagne a impliqué un niveau sans précédent d’autonomie de l’IA dans les cyberattques et marque ce que les experts en sécurité considèrent comme un tournant dans l’espionnage informatique. La capacité des systèmes d’IA à mener des attaques sophistiquées à la vitesse de la machine avec une surveillance humaine minimale soulève de nouveaux défis pour les défenseurs de la cybersécurité.

L’annonce d’Anthropic intervient alors que les entreprises d’IA sont sous pression pour empêcher une utilisation malveillante de leurs modèles. L’entreprise maintient un programme complet d’intelligence sur les menaces et de sauvegardes pour détecter et contrer les abus de Claude, avec des incidents de sécurité documentés tout au long de 2025. En mars, l’entreprise a identifié une opération d’influence en tant que service qui a utilisé Claude pour automatiser l’engagement avec des dizaines de milliers de comptes de médias sociaux dans plusieurs pays et langues.

L’incident souligne la sophistication croissante des outils alimentés par l’IA et les défis pour empêcher leur abus tout en maintenant leur utilité pour les utilisateurs légitimes. Anthropic a interdit les comptes associés et continue d’améliorer ses capacités de détection et d’atténuation pour faire face au paysage de menaces en évolution.

Alex McFarland est un journaliste et écrivain en intelligence artificielle qui explore les derniers développements en intelligence artificielle. Il a collaboré avec de nombreuses startups et publications en intelligence artificielle dans le monde entier.