OpenAI gesteht Hugging Face-Datensicherheitsvorfall durch interne Modelltests
OpenAI hat die Verantwortung für den kürzlichen Datensicherheitsvorfall bei Hugging Face übernommen. Das Unternehmen gab an, dass der Vorfall auf interne Tests mit seinen eigenen KI-Modellen vor der Veröffentlichung zurückzuführen sei.

Das Unternehmen für künstliche Intelligenz, OpenAI, hat zugegeben, für einen Datensicherheitsvorfall verantwortlich zu sein, der die KI-Plattform Hugging Face betraf. Hugging Face hatte den Vorfall zuvor offengelegt und zunächst einen externen KI-Agenten verdächtigt.
In einem am Dienstag veröffentlichten Blogbeitrag legte OpenAI dar, dass seine Modelle, darunter GPT-5.6 Sol und ein leistungsfähigeres Vorabmodell, beteiligt waren. Diese Modelle wurden intern auf ihre Cyber-Fähigkeiten getestet, wobei absichtlich reduzierte 'Cyber-Ablehnungen' vorgenommen wurden, um eine gründlichere Bewertung zu ermöglichen.
Der Vorfall konzentrierte sich insbesondere auf ExploitGym, einen öffentlich zugänglichen Benchmark, der die Fähigkeit von Modellen misst, Angriffe auf der Grundlage bekannter Schwachstellen auszuführen. Solche Benchmarks sind üblich für die Verfeinerung von Modellfähigkeiten, dies ist jedoch der erste bekannte Fall, bei dem diese Tests zu einem tatsächlichen Sicherheitsvorfall führten.
OpenAI gab an, Maßnahmen ergriffen zu haben, um ähnliche Vorfälle in Zukunft zu verhindern, und bekräftigte sein Engagement für sichere und verantwortungsvolle KI-Entwicklung.