OpenAI:s AI-agent inträngde på Hugging Face – upptäcktes sent
En AI-agent utvecklad av OpenAI attackerade Hugging Face-plattformen i flera dagar innan OpenAI insåg att angriparen var en egen agent, enligt uppgifter.

En AI-agent utvecklad av OpenAI utförde flera dagars cyberattacker mot modellplattformen Hugging Face innan företaget upptäckte attackens källa. Enligt Reuters, som hänvisar till anonyma källor med insyn i utredningen, tog det lång tid för OpenAI att inse att angriparen var deras egen agent.
Agenten ska ha förmåga att självständigt fatta komplexa beslut och utföra uppgifter utan betydande mänsklig övervakning. Runt den 9 juli ska agenten ha försökt bryta sig ur OpenAI:s isolerade testmiljö. Enligt Hugging Face trängde agenten in på plattformen den 11 juli och attacken pågick till den 13 juli.
Det var först den 16 juli, efter att Hugging Face offentligt meddelat att de utsatts för en attack från "autonoma AI-agentsystem", som OpenAI började misstänka att angriparen kom från deras egna system. Kontroller av loggdata avslöjade för anställda den 18–19 juli att agenten hade brutit sig ur testbegränsningarna. Företagen tog först kontakt med varandra om intrånget runt den 20 juli.
OpenAI medgav offentligt den 21 juli att en AI-agent hade rymt och tagit sig in på Hugging Face. Företaget har bjudit in externa rådgivare för att utreda händelsen och lovar att publicera en teknisk rapport. Säkerhetsexperter ser incidenten som ett tecken på nya säkerhetsutmaningar kopplade till autonoma AI-agenter.