Leaders d’opinion

Votre agent n’est plus juste un chatbot – Pourquoi le traitez-vous encore comme tel ?

mm
Ajouter Unite.AI à vos sources préférées sur Google

Au début de l’ère de l’intelligence artificielle générative, le pire scénario pour un chatbot malveillant était souvent rien de plus qu’une honte publique. Un chatbot pouvait halluciner des faits, cracher du texte biaisé ou même vous insulter. C’était déjà suffisamment grave. Mais maintenant, nous leur avons confié les clés.

Bienvenue dans l’ère des agents.

De Chatbot à Agent : Le Changement d’Autonomie

Les chatbots étaient réactifs. Ils restaient dans leurs limites. Posez une question, obtenez une réponse. Mais les agents d’IA – en particulier ceux construits avec l’utilisation d’outils, l’exécution de code et la mémoire persistante – peuvent effectuer des tâches mult étapes, invoquer des API, exécuter des commandes et écrire et déployer du code de manière autonome.

En d’autres termes, ils ne répondent plus simplement aux invites – ils prennent des décisions. Et comme tout professionnel de la sécurité vous le dira, une fois qu’un système commence à agir dans le monde, vous devez vous sérieusement préoccuper de la sécurité et du contrôle.

Ce que nous avons averti en 2023

Chez OWASP, nous avons commencé à avertir de ce changement il y a plus de deux ans. Dans la première version de la liste des dix principaux risques pour les applications LLM, nous avons créé un terme : Excessive Agency.

L’idée était simple : lorsque vous donnez à un modèle trop d’autonomie – trop d’outils, trop d’autorité, trop peu de surveillance – il commence à agir plus comme un agent libre que comme un assistant limité. Peut-être qu’il planifie vos réunions. Peut-être qu’il supprime un fichier. Peut-être qu’il provisionne une infrastructure cloud excessive et coûteuse.

Si vous n’êtes pas prudent, il commence à se comporter comme un adjoint confus… ou pire, un agent dormant ennemi qui attend d’être exploité dans un incident de cybersécurité. Dans des exemples réels récents, des agents de produits logiciels importants tels que Microsoft Copilot, Salesforce’s Slack product ont été montrés comme étant vulnérables à l’être trompés pour utiliser leurs privilèges élevés pour exfiltrer des données sensibles.

Et maintenant, cet hypothétique ressemble moins à de la science-fiction et plus à votre feuille de route pour le troisième trimestre.

Rencontrez MCP : La Couche de Contrôle des Agents (ou est-ce ?)

Avancez jusqu’en 2025, et nous voyons une vague de nouvelles normes et de protocoles conçus pour gérer cette explosion de fonctionnalités d’agent. Le plus important de ces protocoles est le Model Context Protocol (MCP) d’Anthropic – un mécanisme pour maintenir une mémoire partagée, des structures de tâches et un accès aux outils à travers des sessions d’agents d’IA à long terme.

Pensez au MCP comme à la colle qui maintient le contexte d’un agent ensemble à travers les outils et le temps. C’est une façon de dire à votre assistant de codage : « Voici ce que vous avez fait jusqu’à présent. Voici ce que vous êtes autorisé à faire. Voici ce que vous devriez vous rappeler. »

C’est un pas nécessaire. Mais cela soulève de nouvelles questions.

MCP est un activateur de capacités. Où sont les limites de sécurité ?

Jusqu’à présent, l’accent a été mis sur l’expansion de ce que les agents peuvent faire – et non sur la réduction de leurs capacités.

Alors que le protocole aide à coordonner l’utilisation des outils et à préserver la mémoire à travers les tâches des agents, il n’aborde pas encore des préoccupations critiques telles que :

  • Résistance à l’injection de invites : Que se passe-t-il si un attaquant manipule la mémoire partagée ?
  • Étendue des commandes : L’agent peut-il être trompé pour dépasser ses autorisations ?
  • Abus de jetons : Un jeton de mémoire fuité pourrait-il exposer des informations d’identification d’API ou des données utilisateur ?

Ce ne sont pas des problèmes théoriques. Un examen récent des implications de sécurité a révélé que les architectures de type MCP sont vulnérables à l’injection d’invites, à l’abus de commandes et même à l’empoisonnement de la mémoire, en particulier lorsque la mémoire partagée n’est pas correctement délimitée ou chiffrée.

C’est le problème classique « puissance sans surveillance ». Nous avons construit l’exosquelette, mais nous n’avons pas encore trouvé où se trouve l’interrupteur.

Les DSI devraient prêter attention – maintenant

Nous ne parlons pas de technologie future. Nous faisons référence à des outils que vos développeurs utilisent déjà et qui ne font que commencer une massive mise en œuvre que nous allons voir dans l’entreprise.

Les agents de codage comme Claude Code et Cursor gagnent une véritable traction à l’intérieur des flux de travail de l’entreprise. Les recherches internes de GitHub ont montré que Copilot pouvait accélérer les tâches de 55 %. Plus récemment, Anthropic a rapporté que 79 % de l’utilisation de Claude Code était axée sur l’exécution automatique de tâches, et non seulement sur les suggestions de code.

C’est une véritable productivité. Mais c’est aussi une véritable automatisation. Ce ne sont plus des copilotes. Ils volent de plus en plus seuls. Et le cockpit ? Il est vide.

Le PDG de Microsoft, Satya Nadella, a récemment déclaré que l’IA écrit jusqu’à 30 % du code de Microsoft. Le PDG d’Anthropic, Dario Amodei, est allé encore plus loin, prédisant que l’IA générera 90 % du nouveau code dans les six mois.

Et ce n’est pas seulement le développement de logiciels. Le Model Context Protocol (MCP) est maintenant intégré dans des outils qui vont au-delà du codage, englobant la gestion des e-mails, la préparation des réunions, la planification des ventes, la synthèse des documents et d’autres tâches de productivité à haute valeur pour les utilisateurs généraux. Même si bon nombre de ces cas d’utilisation sont encore à leurs débuts, ils mûrissent rapidement. Cela change les enjeux. Il ne s’agit plus seulement d’une discussion pour votre CTO ou votre VP de l’ingénierie. Cela exige l’attention des dirigeants d’unités commerciales, des CIO, des DSI et des directeurs généraux de l’IA. À mesure que ces agents commencent à interagir avec des données sensibles et à exécuter des flux de travail transversaux, les organisations doivent veiller à ce que la gouvernance, la gestion des risques et la planification stratégique soient intégrées à la conversation dès le départ.

Ce qui doit se passer ensuite

Il est temps d’arrêter de penser à ces agents comme des chatbots et de commencer à les considérer comme des systèmes autonomes avec de véritables exigences de sécurité. Cela signifie :

  • Limites de privilèges des agents : tout comme vous n’exécutez pas chaque processus en tant que root, les agents ont besoin d’un accès limité aux outils et aux commandes.
  • Gouvernance de la mémoire partagée : La persistance du contexte doit être auditée, versionnée et chiffrée – en particulier lorsqu’elle est partagée entre sessions ou équipes.
  • Simulations d’attaque et test de pénétration : L’injection d’invites, l’empoisonnement de la mémoire et l’abus de commandes doivent être traités comme des menaces de sécurité de premier ordre.
  • Formation des employés : L’utilisation sûre et efficace des agents d’IA est une nouvelle compétence, et les gens ont besoin de formation. Cela les aidera à être plus productifs et à maintenir votre propriété intellectuelle plus sécurisée.

Lorsque votre organisation se lance dans les agents intelligents, il est souvent préférable de marcher avant de courir. Acquérez de l’expérience avec des agents qui ont une portée limitée, des données limitées et des autorisations limitées. Apprenez-en en construisant des garde-fous organisationnels et en acquérant de l’expérience, puis passez à des cas d’utilisation plus complexes, autonomes et ambitieux.

Vous ne pouvez pas vous asseoir sur cette question

Que vous soyez un directeur général de l’IA ou un directeur des systèmes d’information, vous pouvez avoir des préoccupations initiales différentes, mais votre chemin à suivre est le même. Les gains de productivité liés aux agents de codage et aux systèmes d’IA autonomes sont trop convaincants pour être ignorés. Si vous adoptez encore une approche « attendre et voir », vous êtes déjà en retard.

Ces outils ne sont plus expérimentaux – ils deviennent rapidement des éléments essentiels. Des sociétés comme Microsoft génèrent une grande partie de leur code grâce à l’IA et améliorent leurs positions concurrentielles en conséquence. Des outils comme Claude Code réduisent le temps de développement et automatisent des flux de travail complexes dans de nombreuses entreprises à travers le monde. Les entreprises qui apprennent à exploiter ces agents en toute sécurité seront livrer plus rapidement, s’adapter plus rapidement et surpasser leurs concurrents.

Mais la vitesse sans sécurité est un piège. Intégrer des agents autonomes dans votre entreprise sans contrôles appropriés est une recette pour des pannes, des fuites de données et des réactions négatives réglementaires.

C’est le moment d’agir – mais agir intelligemment :

  • Lancez des programmes pilotes d’agents, mais exigez des examens de code, des autorisations d’outils et des sandbox.
  • Limitez l’autonomie à ce qui est nécessaire – pas tous les agents ont besoin d’un accès root ou d’une mémoire à long terme.
  • Audit la mémoire partagée et les appels d’outils, en particulier à travers des sessions à long terme ou des contextes collaboratifs.
  • Simulez les attaques en utilisant l’injection d’invites et l’abus de commandes pour découvrir des risques réels avant que les attaquants ne le fassent.
  • Formez vos développeurs et vos équipes de produits sur les modèles d’utilisation sûrs, y compris le contrôle de portée, les comportements de secours et les voies d’escalade.

La sécurité et la vitesse ne sont pas mutuellement exclusives – si vous construisez avec intention.

Les entreprises qui traitent les agents d’IA comme une infrastructure de base, et non comme des jouets ou des menaces, seront celles qui prospéreront. Les autres seront laissés pour nettoyer les désordres – ou pire, regarder depuis les côtés.

L’ère des agents est arrivée. Ne réagissez pas simplement. Préparez-vous. Intégrez. Sécurisez.

Steve Wilson est le directeur des opérations d'intelligence artificielle chez Exabeam, où il dirige le développement de solutions de cybersécurité avancées basées sur l'intelligence artificielle pour les entreprises mondiales. Un dirigeant expérimenté dans le domaine de la technologie, Wilson a passé sa carrière à concevoir des plateformes cloud à grande échelle et des systèmes sécurisés pour les organisations du Global 2000. Il est largement respecté dans les communautés d'intelligence artificielle et de sécurité pour son rôle dans l'intégration de l'expertise technique approfondie avec les applications réelles des entreprises. Wilson est également l'auteur de The Developer’s Playbook for Large Language Model Security (O’Reilly Media), un guide pratique pour sécuriser les systèmes GenAI dans les piles logicielles modernes.