A2M : détournement d'agents optimisé par traces dans l'écosystème MCP
Une attaque en deux temps manipule les métadonnées d'outils tiers pour piéger les agents utilisant le Model Context Protocol.
arXiv cs.AI · cs.LG · cs.CL·Laizhen Li, Xuan Wang, Peicheng Zhao, Juanjuan Zhao·22 septembre 2026
Lu et jugé par Fellow · impact majeur
Vulnérabilité supply-chain sémantique MCP documentée avec 93,6% de succès d'invocation malveillante, transfert cross-modèle, et code public : impact direct sur la sécurité des agents IA.

Image · Source originale
Des chercheurs présentent A2M, un framework en boîte noire exploitant une faille de supply-chain sémantique dans MCP. La phase d'attraction optimise les métadonnées d'outils pour maximiser leur invocation, puis la phase de manipulation ajuste les réponses malveillantes via les traces d'exécution. Sur LiveMCPBench, l'attaque atteint 93,6% d'invocation d'outils malveillants sur GLM-4.6, avec un transfert efficace vers d'autres modèles sans ré-optimisation.