Ciscon tutkimus: 88 % tekoälymalleista murtui monikierroksisissa hyökkäyksissä
Ciscon mukaan 88,3 % testatuista tekoälymalleista oli haavoittuvaisia monikierroksisille hyökkäyksille. Yksinkertaiset yksittäiskierros testit eivät paljastaneet näitä riskejä.

Cisco paljasti merkittävän haavoittuvuuden tekoälymalleissa. Yhtiön tekemissä testeissä 88,3 % tutkituista malleista murtui monikierroksisissa hyökkäyksissä, joissa hyökkääjä kehitti taktiikkaansa keskustelun edetessä. Amy Chang, Ciscon tekoälyuhkatiedustelun ja tietoturvatutkimuksen johtaja, esitteli löydökset VB Transform 2026 -tapahtumassa.
Tutkimuksessa käytettiin 6 986 monikierroksista hyökkäystä 15 eri tekoälymallia vastaan. Tulokset osoittivat, että yksinkertaiset, yksittäiskierroksiset testausmenetelmät jättävät huomiotta merkittäviä riskejä. Chang korosti, että monikierroksiset hyökkäykset mallintavat realistisemmin todellisia vuorovaikutustilanteita tekoälyn kanssa, paljastaen haitallisia toimintoja, joita lyhyet testit eivät havaitse.
Ciscon raportti perustuu laajempaan tutkimukseen, jossa oli mukana 30 090 yksittäiskierroksista kehotetta ja 6 986 monikierroksista hyökkäystä. Mallien onnistumisasteet monikierroksisissa hyökkäyksissä vaihtelivat 7,89 %:sta 88,3 %:iin. Jokaisessa testatussa mallissa havaittiin merkittävää haavoittuvuutta pidemmissä hyökkäyssykleissä.
Amy Chang kehotti yrityksiä tarkistamaan tietoturvakäytäntönsä. Hän korosti, että ilman ymmärrystä mallien eri hyökkäystyyppien alttiuksista, organisaatiot eivät pysty tunnistamaan heikkouksia. Cisco julkaisee tuloksia LLM Security Leaderboard -listallaan, joka arvioi jo yli 105 mallia.