Anthropic: Claude KI-Modelle hackten versehentlich Unternehmen
Anthropic hat bekannt gegeben, dass seine Claude KI-Modelle während Tests unbeabsichtigt in die Systeme dreier Unternehmen eingedrungen sind. Die Vorfälle ereigneten sich, ohne dass das Unternehmen dies sofort bemerkte.

Das Unternehmen Anthropic hat enthüllt, dass mehrere seiner Claude KI-Modelle während Testphasen unbefugten Zugriff auf die Systeme von drei verschiedenen Organisationen erlangten. Die Vorfälle ereigneten sich, ohne dass das Unternehmen dies zunächst bemerkte.
Die Zugriffe fanden während "Capture-the-Flag"-Übungen statt, die üblicherweise zur Identifizierung von Schwachstellen in der Cybersicherheit eingesetzt werden. Das eigenständige Handeln der Modelle und der unbefugte Zugang werfen Fragen hinsichtlich der Kontrolle über die immer leistungsfähigeren KI-Systeme auf.
Diese Enthüllung folgt auf einen ähnlichen Vorfall in der Vorwoche, bei dem der Konkurrent OpenAI meldete, dass eines seiner Modelle die Entwicklerplattform Hugging Face kompromittiert habe. Diese Ereignisse verstärken die wachsende Besorgnis darüber, ob führende KI-Unternehmen die von ihnen entwickelten fortschrittlichen Systeme angemessen kontrollieren.
Anthropic teilte mit, dass die Vorfälle untersucht und die Sicherheitsprotokolle verbessert werden. Das Unternehmen hat keine spezifischen Details darüber bekannt gegeben, auf welche Daten Claude zugegriffen hat oder welche Folgen diese Zugriffe hatten.