OpenAI führt Wasserzeichen für KI-generierte Texte in der EU ein
OpenAI wird ein statistisches Wasserzeichen für von seinen Modellen generierte Texte in der Europäischen Union einführen. Das System soll KI-produzierte Inhalte identifizieren, stößt jedoch auf erkennbare Grenzen.
Das KI-Unternehmen OpenAI hat angekündigt, ab sofort KI-generierte Texte in der Europäischen Union mit einem unsichtbaren statistischen Wasserzeichen zu versehen. Dieses Verfahren, genannt textGrain, soll helfen, von Modellen wie ChatGPT und Codex erstellte Inhalte zu erkennen. Die Einführung des Wasserzeichens beginnt in den kommenden Wochen.
Das Wasserzeichen verändert statistische Muster in der Wortwahl der Modelle, ohne sichtbare Markierungen oder versteckte Zeichen hinzuzufügen. Ein spezieller Detektor prüft dann, ob ein Text diese Muster aufweist. Der Zugang zum Detektor wird zunächst auf genehmigte Forscher und Organisationen beschränkt. OpenAI betont, dass der Detektor nicht den Nutzer identifiziert oder Anfragen oder Konversationen preisgibt.
OpenAI räumt deutliche Einschränkungen bei der Wasserzeichenerkennung ein. Tests zeigen, dass der Detektor bei längeren Texten zuverlässiger arbeitet. Bei kürzeren, stark bearbeiteten oder inhaltlich eingeschränkten Texten nimmt die Erkennungsrate ab. Beispielsweise reduzierte der Austausch von nur 10 Prozent der Wörter durch Synonyme in einem 400-Token-Text die Erkennungsrate von etwa 92 Prozent auf 66 Prozent.
Das Unternehmen stellt klar, dass ein Wasserzeichen weder den Eigentümer noch die Genauigkeit des Textes feststellen kann und auch nicht den Urheber benennt. Umgekehrt beweist das Fehlen eines erkannten Wasserzeichens nicht, dass ein Mensch den Text verfasst hat. Diese Einschränkungen sind laut OpenAI ein Grund, warum der Detektor vorerst nicht öffentlich zugänglich gemacht wird.
Die Maßnahme steht im Einklang mit den EU-Vorschriften, die eine maschinenlesbare Kennzeichnung von KI-generierten Inhalten fordern. OpenAI betrachtet das Wasserzeichen derzeit als Signal, dass ein OpenAI-System den Text erzeugt oder verarbeitet haben könnte, nicht als endgültigen Beweis für KI-Urheberschaft.