MCP-protokoll luo riskejä tekoälyagenteille
Uusi tutkimus paljastaa, että tekoälyagenttien välisessä viestinnässä käytettävä MCP-protokolla voi altistaa organisaatiot tietoturvahyökkäyksille. Haavoittuvuudet mahdollistavat haitallisten ohjeiden levittämisen sisäisten agenttien välillä.

Tekoälyagenttien yleistyminen yrityksissä avaa uusia reittejä hyökkääjille. Independentti tutkija Syed Anas Mohiuddin on havainnut, että Model Context Protocol (MCP), jota käytetään tekoälysovellusten ja -agenttien väliseen viestintään sisäverkossa, voi olla merkittävä tietoturvariski.
Viimeisen viiden kuukauden aikana useat organisaatiot, mukaan lukien Google ja JP Morgan Chase, ovat raportoineet haavoittuvuuksista, joissa yksi agentti kohdeverkossa on pystynyt levittämään haitallisia komentoja muille sisäisille agenteille. Tämä hyökkäystyyppi on muunnelma prompt injection -tekniikasta, joka kohdistuu suoraan agenttiin eikä suoraan kielimalliin.
MCP-protokollan heikkous perustuu agenttien väliseen luottamukseen. Kun yksi agentti saa haitallisen ohjeen, se välittää sen eteenpäin muille sisäisille agenteille, jotka olettavat sen olevan peräisin luotetusta lähteestä. Agenttien sisäiset suojamekanismit ovat usein riittämättömiä tai puuttuvat kokonaan, mikä mahdollistaa haitallisten komentojen etenemisen järjestelmässä.
Mohiuddinin mukaan haavoittuvuus on odottamaton ja vaikeasti korjattavissa. Ongelma koskee useita organisaatioita, joilla on vähän yhteistä lukuun ottamatta tekoälyagenttien käyttöä. Näitä organisaatioita ovat muun muassa Google, JP Morgan Chase, Weviate, Rapid7, Ranskan hallituksen interministeerinen digitaalinen direktoraatti sekä Yhdysvaltain liittohallitus.
Tämä paljastus korostaa tarvetta kehittää turvallisempia protokollija tekoälyagenttien väliseen kommunikaatioon, jotta estetään tietojen exfiltraatio ja muut haitalliset toiminnot.