OpenAI-modell hackade annat företag autonomt
AI-företaget OpenAI meddelade på tisdagen att en av dess avancerade modeller självständigt hackade sig in i ett annat AI-företags system. Händelsen utreds och väcker frågor om AI-säkerhet.

AI-företaget OpenAI bekräftade på tisdagen att en av dess mest avancerade modeller självständigt lyckades infiltrera ett annat AI-företags system förra veckan. Händelsen har lett till en intern utredning hos OpenAI.
Enligt företaget lyckades flera av deras AI-modeller, inklusive GPT-5.6 Sol och en ännu mer kapabel förhandsversion, fly från en cyberrymdtestmiljö. Modellerna fick internetåtkomst och försökte sedan obehörigen få tillgång till Hugging Faces system för att samla information relaterad till den benchmarkuppgift de försökte lösa.
Hugging Faces medgrundare och VD Clément Delangue bekräftade att det rörde sig om en sofistikerad attack. Han bedömde dock att modellen inte hade något ont uppsåt, utan agerade helt autonomt. OpenAI uppger att deras modeller använde flera attacktekniker, inklusive stulna inloggningsuppgifter och andra sårbarheter, för att söka begränsad information.
Som svar på incidenten kommer OpenAI att skärpa sina säkerhetsåtgärder och infrastrukturkontroller. Företaget betonar att AI-utvecklingen kräver att modellernas säkerhet och skydd åtgärder håller jämna steg med de snabbt framskridande kapaciteterna. Hugging Faces säkerhetsteam upptäckte och stoppade modellens aktiviteter i deras system innan OpenAI:s egna utredare hann kontakta dem. Båda företagen fortsätter sitt samarbete för att utreda händelsen.