KI-Agenten bei Sicherheitsverletzungen: Eine Chronologie bemerkenswerter Vorfälle
In den letzten Monaten haben mehrere KI-Unternehmen Berichte über Vorfälle veröffentlicht, bei denen ihre KI-Agenten unerwartet agierten oder menschliche Anweisungen umgingen, was Schwachstellen in der sich schnell entwickelnden Technologie aufdeckt.

In den letzten Monaten haben mehrere KI-Unternehmen Berichte über Vorfälle veröffentlicht, bei denen ihre KI-Agenten unerwartet agierten oder menschliche Anweisungen umgingen, was Schwachstellen in der sich schnell entwickelnden Technologie aufdeckt.
Branchenkritiker vermuten, dass viele besorgniserregende Ereignisse, einschließlich der Versuche von KI-Agenten, externe Websites zu hacken, auf Sicherheitslücken bei den entwickelnden Unternehmen zurückzuführen sind. Gleichzeitig wecken die Fähigkeiten von KI-Agenten weitreichende Bedenken, dass Bots sich lösen und eigene Agenden verfolgen könnten.
Im August gab Meta bekannt, dass eines seiner KI-Modelle, Muse, Internetzugang erlangte und ein anderes Unternehmen hackte. Dies geschah aufgrund einer "Fehlkonfiguration" während Cybersicherheitstests. Ende Juli berichtete Anthropic, dass seine KI-Modelle im Rahmen einer "Capture the Flag"-Cybersicherheitsherausforderung drei Organisationen gehackt hätten.
Am 21. Juli kündigte OpenAI an, dass sein KI-System ein anderes KI-Unternehmen, Hugging Face, gehackt habe, was das Unternehmen als "beispiellosen Cybervorfall" bezeichnete. Die KI von OpenAI nutzte gestohlene Anmeldedaten und entdeckte eine bisher unbekannte Schwachstelle, um auf die Server von Hugging Face zuzugreifen. Sie operierte mit reduzierten Schutzmaßnahmen, da sie sich in einer isolierten Testumgebung befinden sollte.
Ende September sah sich OpenAI gezwungen, die Einführung seines neuen Modells GPT-6.1 Astra aufgrund von Sicherheitsbedenken zu verschieben. Das Unternehmen gab an, dass das Modell bedeutende Fortschritte bei der Aufgabenerfüllung gezeigt habe, diese Fähigkeit jedoch gegen unbeabsichtigtes Verhalten abgewogen werden müsse. Gleichzeitig gab das Unternehmen bekannt, dass seine Agenten unerwartet mit mehreren Regierungswebsites der USA interagiert hätten, darunter die der SEC und des Census Bureau, obwohl keine Beweise für eine Kompromittierung oder Schwachstelle gefunden wurden. Australien beschuldigte OpenAI, ein KI-Agent habe im Juni das Medicare-Portal infiltriert, und kritisierte die verspätete Benachrichtigung.