YouTube erweitert Schutz vor Stimmklonen
YouTube integriert Spracherkennung in sein Werkzeug zur Erkennung von Ähnlichkeiten, um Urheber besser vor KI-generierten Stimmenklonen zu schützen. Die Funktion wird auch mobil verfügbar sein.
YouTube kündigte am 23. September an, die Spracherkennung in sein Werkzeug zur Erkennung von Ähnlichkeiten zu integrieren, zusätzlich zur bestehenden Gesichtserkennung. Diese Erweiterung zielt darauf ab, Urhebern einen verbesserten Schutz vor der unbefugten Klone ihrer Stimmen und ihres Erscheinungsbilds zu bieten.
Das Unternehmen gab an, dass die neue Spracherkennungsfunktion die allgemeine Treffsicherheit verbessern und die Grundlage für breitere Stimmenschutzmaßnahmen in der Zukunft legen wird. Das Werkzeug zur Erkennung von Ähnlichkeiten wird auch über die mobile YouTube-App zugänglich sein, sodass Urheber sich anmelden, Treffermeldungen erhalten und direkt von ihren Smartphones aus handeln können.
Diese Entwicklung erfolgt vor dem Hintergrund zunehmender rechtlicher Prüfung von KI-gestützter Stimmklonierung in Ländern wie Indien, wo Gerichte Unterlassungsanordnungen gegen die unbefugte Stimmklonierung für Prominente erlassen haben. Während sich YouTubes Werkzeug derzeit auf die Verbesserung der Genauigkeit bei der Gesichtserkennung konzentriert, adressiert die Einbeziehung der Spracherkennung Bedenken hinsichtlich Audio-Deepfakes. Die Plattform hat noch nicht spezifiziert, wann die Spracherkennung in Indien verfügbar sein wird.
Zur Nutzung des Dienstes müssen sich Urheber anmelden, indem sie einen staatlich ausgestellten Ausweis und ein Selfie-Video bereitstellen. YouTube wird diese Daten zusammen mit Stimmenvorlagen bis zu drei Jahre lang speichern. Die Plattform behält sich das Recht vor, markierte Inhalte zu überprüfen und berücksichtigt Faktoren wie Parodie und Satire, bevor Maßnahmen ergriffen werden.
Die Ähnlichkeitserkennung wurde ursprünglich im Oktober 2025 für Mitglieder des YouTube Partner Programms eingeführt und wurde seitdem auf Journalisten, Amtsträger und Prominente ausgeweitet. Die Hinzufügung der Spracherkennung stellt einen wichtigen Schritt zur Bewältigung der Herausforderungen dar, die durch KI-generierte Inhalte entstehen, obwohl Fragen zu ihren vollen Fähigkeiten und der regionalen Einführung bestehen bleiben.