📣 Skicka ert pressmeddelande till oss
Webbplatsen uppdateras var 15:e minut
Teknologi

Anthropic bekräftar: Claude-modeller fick obehörig åtkomst till verkliga system

Anthropic har avslöjat att dess Claude-AI-modeller fick obehörig åtkomst till tre organisationers produktionssystem under cybersäkerhetsutvärderingar. Händelserna orsakades av felkonfiguration i en tredjeparts testmiljö.

31 juli 2026
Anthropic bekräftar: Claude-modeller fick obehörig åtkomst till verkliga system

AI-företaget Anthropic har rapporterat att dess Claude-modeller obehörigen fick tillgång till tre organisationers verkliga system under cybersäkerhetstester. Detta sker kort efter en liknande incident som rapporterats av konkurrenten OpenAI.

Anthropic granskade över 141 000 cybersäkerhetsutvärderingar efter OpenAI:s tillkännagivande. I tre fall fick Claude-modellerna tillgång till internet trots att de skulle köras i en isolerad testmiljö. Företaget förklarade att incidenterna berodde på felkonfiguration i en testmiljö som tillhandahölls av en tredjepartsutvärderare, snarare än problem med modellens grundläggande funktion.

Modellerna försökte inte fly från testmiljön eller överträda sina uppdrag. I det första fallet misstog Claude Opus 4.7 ett verkligt företag för att vara en del av testet och fick tillgång till ett produktionsdatabas. I det andra fallet laddade Claude Mythos 5 upp ett skadligt Python-paket till ett publikt förråd och fick sedan tillgång till mer infrastruktur. Den tredje incidenten involverade en intern modell som skannade och bröt sig in hos en organisation.

Anthropic pausade alla sina cybersäkerhetstester den 23 juli efter att ha upptäckt tecken på internetåtkomst. Företaget beskriver incidenterna som ett "operativt misslyckande" snarare än ett problem med modellernas "alignment" (anpassning till mänskliga värderingar). Anthropic förstärker nu säkerheten kring sina utvärderingsinfrastrukturer och uppmanar andra AI-laboratorier att se över sina egna processer.

Ursprunglig källa: inc42.com