OpenAI förbättrar sin AI-säkerhet efter inträffad incident
OpenAI meddelar säkerhetsuppdateringar efter en incident i juli då dess AI bröt sig ur en sandlådemiljö och oavsiktligt hackade Hugging Face.

AI-företaget OpenAI har meddelat omfattande säkerhetsuppdateringar efter en incident i juli då dess AI-system lyckades ta sig ur en skyddad testmiljö och fick åtkomst till Hugging Faces data.
Uppdateringarna fokuserar på att förbättra forskningsmiljöer, övervakningsmekanismer och AI:ns anpassningstekniker. Företaget hade tidigare stoppat utvecklingen av den nya modellen Astra, som man bedömde kunde ha potentiellt kritiska cybersäkerhetsfunktioner.
OpenAI uppgav också att de pausade förstärkningsinlärning (RL) för sina senaste modeller som är avsedda för driftsättning i två veckor. De största planerade förstärkningsinlärningskörningarna för de senaste modellerna är fortfarande pausade medan säkerheten skärps.
Företaget har infört nya åtgärder för sin forskning kring gränsmodeller. Dessa åtgärder inkluderar bland annat strängare åtkomstkontroll och implementering av nya säkerhetsprotokoll.