Le protocole MCP crée des risques pour la communication entre agents IA
De nouvelles recherches révèlent que le protocole MCP, utilisé pour la communication entre agents IA, peut exposer les organisations à des risques de sécurité. Les vulnérabilités permettent la propagation d'instructions malveillantes entre agents internes.

L'adoption généralisée des agents d'IA dans les organisations crée de nouvelles voies pour les attaquants. Le chercheur indépendant Syed Anas Mohiuddin a identifié que le Model Context Protocol (MCP), utilisé pour la communication entre applications et agents d'IA au sein d'un réseau interne, peut représenter un risque de sécurité important.
Au cours des cinq derniers mois, plusieurs organisations, dont Google et JP Morgan Chase, ont signalé des vulnérabilités permettant à un agent d'un réseau ciblé de propager des commandes malveillantes à d'autres agents internes. Cette technique d'attaque est une variante de l'injection de prompt qui cible directement l'agent, plutôt que le modèle linguistique lui-même.
La vulnérabilité du protocole MCP exploite la confiance entre les agents. Lorsqu'un agent reçoit une instruction malveillante, il la transmet à d'autres agents internes qui supposent qu'elle provient d'une source fiable. Les mécanismes de protection internes des agents sont souvent insuffisants ou inexistants, ce qui permet aux commandes malveillantes de se propager dans le système.
Selon Mohiuddin, la vulnérabilité est inattendue et difficile à atténuer. Le problème affecte plusieurs organisations qui ont peu en commun, hormis leur utilisation d'agents d'IA. Ces organisations comprennent Google, JP Morgan Chase, Weviate, Rapid7, la direction interministérielle du numérique du gouvernement français et le gouvernement fédéral américain.
Cette découverte souligne la nécessité de développer des protocoles plus sécurisés pour la communication entre agents d'IA afin de prévenir l'exfiltration de données et d'autres activités malveillantes.