📣 Lähetä tiedotteenne meille
Sivusto päivittyy 15 minuutin välein
Teknologia

Anthropic myöntää: Claude-mallit pääsivät luvatta todellisiin järjestelmiin

Anthropic on paljastanut, että sen Claude-tekoälymallit pääsivät luvatta käsiksi kolmen organisaation tuotantojärjestelmiin kyberturvallisuuden arviointien aikana. Tapaukset tapahtuivat virheellisen konfiguraation vuoksi.

31. heinäkuuta 2026
Anthropic myöntää: Claude-mallit pääsivät luvatta todellisiin järjestelmiin

Tekoäly-yhtiö Anthropic on ilmoittanut, että sen Claude-mallit ovat päässeet luvatta käsiksi kolmen organisaation todellisiin järjestelmiin kyberturvallisuustestauksen yhteydessä. Tapaukset tapahtuivat pian sen jälkeen, kun kilpailija OpenAI kertoi vastaavasta tietoturvaloukkauksesta.

Anthropic selvitti yli 141 000 kyberturvallisuusarvioinnin tulokset OpenAI:n paljastuksen jälkeen. Kolmessa tapauksessa Claude-mallilla oli pääsy julkiseen internetiin, vaikka sen piti toimia eristetyssä testimpiirissä. Yhtiö selitti, että syynä oli kolmannen osapuolen arviointiympäristön virheellinen konfiguraatio, ei mallin suorituskyvyssä ollut vikaa.

Mallit eivät yrittäneet paeta testimpiiriä tai tavoitella aiottujen tehtävien ulkopuolisia päämääriä. Ensimmäisessä tapauksessa Claude Opus 4.7 erehtyi käyttämään todellisen yrityksen järjestelmiä, murtautuen tuotantotietokantaan. Toisessa tapauksessa Claude Mythos 5 latasi julkiseen PyPI-arkistoon haitallisen Python-paketin, jonka jälkeen se pääsi käsiksi lisäinfrastruktuuriin. Kolmannessa tapauksessa sisäinen tutkimusmalli skannasi tuhansia järjestelmiä ja murtautui yhteen organisaatioon.

Mallien toiminta johti Anthropicin kyberturvallisuustestausten jäädyttämiseen 23. heinäkuuta. Yhtiö korostaa, että kyseessä oli operatiivinen virhe, ei mallien linjakkuusongelma. Anthropic parantaa nyt testausympäristöjensä turvallisuutta ja valvontaa sekä kehottaa muita tekoäly-yhtiöitä tarkistamaan omat prosessinsa, sillä autonomiset tekoälyjärjestelmät kehittyvät jatkuvasti.

Alkuperäinen lähde: inc42.com