Des chercheurs ont réussi la première attaque d’un agent IA contre un autre, exploitant une vulnérabilité dans le kit de développement de Google pour Python.
Cette démonstration, menée par des chercheurs, a ciblé le kit de développement d’agents (ADK) de Google pour Python. Ils ont conçu un agent malveillant capable de manipuler un agent victime afin qu’il exécute des actions non autorisées. L’attaque a exploité la capacité des agents à interagir avec des outils externes, permettant au code malveillant de s’infiltrer et de contrôler le comportement de l’agent ciblé.
Cette première attaque agent contre agent en conditions réelles marque une étape significative dans la compréhension des risques de sécurité liés aux systèmes autonomes. Elle souligne l’importance cruciale de la robustesse des mécanismes d’interprétation et d’exécution des instructions au sein des architectures d’agents. Google, informé de cette vulnérabilité, a confirmé travailler activement à l’élaboration d’un correctif pour son ADK.
Cet incident ouvre de nouvelles perspectives quant à la sécurisation des interactions entre agents intelligents et la prévention des détournements futurs.
Source : Numerama