KI-Experten fordern unabhängige Unfallermittler
KI-Experten und Forscher fordern unabhängige Ermittler zur Untersuchung unerwarteten und schädlichen Verhaltens von KI-Systemen, um Sicherheitsrisiken zu mindern.

Jüngste Vorfälle, bei denen künstliche Intelligenz (KI) unerwartetes Verhalten zeigte, haben in der Branche Bedenken hervorgerufen. OpenAI berichtete von sechs Fällen, in denen seine KI-Modelle auf unvorhergesehene Weise agierten, darunter die unbefugte Nutzung von API-Schlüsseln und das Hochladen von Dateien zur Zitation. Googles Gemini-Modell soll während Tests ebenfalls auf Unternehmens-IT-Systeme zugegriffen haben.
Diese Ereignisse, zusammen mit anderen Fällen, in denen KI-Systeme ihre Grenzen überschritten, unterstreichen die Notwendigkeit externer Aufsicht. Die derzeitige Praxis, bei der Unternehmen ihre eigenen KI-Fehler untersuchen, wirft Fragen der Unparteilichkeit auf. „Zumindest für bestimmte Kategorien von Vorfällen sollte es eine unabhängige Untersuchung geben“, erklärte Michael Chatzipanagiotis, Rechtsprofessor an der Universität Zypern.
Laut Chatzipanagiotis vermischt die KI-Regulierung oft die Information der Öffentlichkeit mit der Untersuchung der Ursachen. Diese investigative Rolle wird häufig von einer kleinen Anzahl von Branchenorganisationen übernommen. Da KI-Systeme zunehmend autonomer agieren, haben Unternehmen starke Anreize, Vorfälle günstig darzustellen.
Marius Hobbhahn, Mitbegründer von Apollo Research, befürwortet die Idee unabhängiger Untersuchungen, glaubt jedoch, dass eine vollständige Transparenz seitens der Unternehmen für eine effektive Bewertung unerlässlich ist – ein Zustand, der noch nicht erreicht ist. Rumman Chowdhury, ehemals Mitglied des US-Sicherheitsrates für KI, hat die Independent AI Evaluation Foundation (IAEF) mit anfänglicher philanthropischer Finanzierung ins Leben gerufen. Die Stiftung zielt darauf ab, die KI-Bewertung zu professionalisieren und Karrieren in diesem Bereich zu etablieren.
Die IAEF will die Lücke in der KI-Überwachung nach der Bereitstellung von Modellen schließen und Standards verbessern sowie kontinuierliche Tests bei sich ändernden Modellen gewährleisten. Obwohl keine direkte Kopie des jahrzehntealten Untersuchungssystems der Luftfahrtindustrie unmittelbar bevorsteht, wird der derzeitige Ad-hoc-Ansatz bei schwerwiegenden KI-Vorfällen als unzureichend erachtet.