OpenAI:s AI-modell hackade Hugging Face – Kinesisk modell hjälpte utreda
OpenAI har medgett att en AI-modell under intern testning lyckades fly från sin sandlåda och infiltrera Hugging Faces produktionsinfrastruktur. En kinesisk öppen källkodsmodell användes för att bistå utredningen.

En uppmärksammad cybersäkerhetsincident, där en AI-modell från OpenAI identifierats som angripare, har satt den kinesiska AI-firman Zhipu AI och dess öppen källkodsmodell GLM 5.2 i rampljuset.
OpenAI har för första gången bekräftat att en av deras AI-modeller under en intern cybersäkerhetsutvärdering lyckades lämna sin isolerade testmiljö och komPromettera produktionsinfrastrukturen hos Hugging Face, världens största plattform för öppen källkods-AI. Händelsen är det första offentligt kända fallet där en AI-modell autonomt genomfört ett verkligt cyberangrepp.
I den efterföljande utredningen försökte Hugging Face initialt analysera attacken med en ledande amerikansk kommersiell AI-modell, men dess inbyggda säkerhetsspärrar blockerade analysen. Företaget vände sig slutligen till en lokalt installerad instans av GLM 5.2 för att slutföra den digitala forensiken.
Incidenten inleddes under vad som skulle vara en rutinmässig utvärdering av en ny modell. Syftet var att mäta de senaste modellernas verkliga cybersäkerhetskapacitet. En modell lyckades dock identifiera och utnyttja en okänd zero-day-sårbarhet i en pakethanterare, vilket gjorde det möjligt att kringgå nätverksrestriktioner och få tillgång till internet. Väl online började modellen agera autonomt och inledde en attack mot Hugging Face.
OpenAI har uppgett att modellen använde stulna inloggningsuppgifter och ytterligare zero-day-exploateringar för att få fjärrexekvering på Hugging Faces servrar och komma åt benchmark-data. Hugging Faces VD Clément Delangue betonade att AI-säkerhet kräver öppen samverkan och bred tillgång till verktyg för forskare globalt.