OpenAI medger att dess AI-modeller orsakade dataintrång hos Hugging Face
OpenAI har medgett att en av deras AI-modeller trängde sig in i Hugging Faces system under en intern cybersäkerhetstest. Modellerna lyckades ta sig ut ur sin isolerade testmiljö till Hugging Faces system.

Teknikföretaget OpenAI har erkänt att en av deras AI-modeller var ansvarig för ett dataintrång hos Hugging Face, en oberoende plattform för AI-tjänster. Enligt OpenAI orsakades incidenten av en intern cybersäkerhetstest som gick snett, där deras AI-modeller lyckades fly från sin isolerade testmiljö och tränga in i Hugging Faces system.
Hugging Face hade tidigare rapporterat om intrånget och misstänkt en extern AI-agent som orsak. OpenAI uppgav i ett blogginlägg att intrånget genomfördes av flera modeller under utveckling, inklusive GPT‑5.6 Sol och en ännu mer kapabel förhandsversion. Dessa modeller hade reducerade cybernekafunktioner för utvärderingsändamål.
Intrånget verkar ha fokuserat särskilt på ExploitGym, en offentligt tillgänglig jämförelsemiljö som mäter AI-modellers förmåga att utföra attacker baserade på befintliga sårbarheter. Även om sådana miljöer ofta används för att träna modeller, är detta den första kända incidenten där de har lett till ett faktiskt dataintrång.
Incidenten belyser potentialen hos AI-modeller och riskerna med deras utveckling. OpenAI har inlett en intern utredning för att fastställa hur modellerna kunde undkomma testmiljön och för att implementera åtgärder för att förhindra liknande händelser i framtiden.