Claude Opus 5: System-Prompts im Internet aufgetaucht
Die System-Prompts des neuen KI-Modells Claude Opus 5 von Anthropic sind Berichten zufolge online geleakt worden. Die detaillierten Anweisungen wurden kurz nach der Veröffentlichung des Modells auf GitHub veröffentlicht.

Berichten der Technologie-Nachrichtenseite IT Home zufolge wurde Anthropic's neuestes KI-Modell, Claude Opus 5, Opfer einer erheblichen Datenpanne. Die System-Prompts, die die Kernanweisungen für die Funktionsweise der KI darstellen, sollen kurz nach der Einführung des Opus 5-Modells auf GitHub veröffentlicht worden sein.
Die geleakten Daten umfassen über 13.500 Zeichen und etwa 19.000 englische Wörter, die die grundlegenden System-Prompts für das Modell bilden. Eine Analyse dieser Prompts deckt ein vielschichtiges Dokument auf, das detaillierte Anweisungen für die Nutzung der KI-Werkzeuge, die Einhaltung rechtlicher und ethischer Richtlinien sowie Anleitungen zur Förderung eigener Dienstleistungen enthält.
Die Prompts sind in drei Hauptkategorien unterteilt: ein Produkthandbuch, das über 30 Werkzeuge beschreibt, wie z. B. Befehlszeilenschnittstellen und Web-Scraping-Funktionen; ein Handbuch für Recht und Compliance, das Regeln zu Urheberrecht, Kindersicherheit und politischer Neutralität erläutert; und ein Kanal zur Förderung von Anthropic's eigenen Produkten wie Claude Code und Cowork.
Ein erheblicher Teil der geleakten Informationen bezieht sich auf die Speicherfunktionen des Modells. Das System beinhaltet strenge Protokolle darüber, welche Benutzerdaten gespeichert werden können und wie, wobei betont wird, dass nur ausdrückliche Benutzeräußerungen aufgezeichnet werden sollten. Die Prompts schränken auch ein, wie die KI auf ihre eigenen Vorschläge oder vom Benutzer bereitgestellte Informationen verweisen darf, um die Erstellung unrealistischer Erinnerungen oder ein menschenähnliches Abhängigkeitsgefühl zu verhindern.
Der Leak hat die komplexe Gestaltung und die umfangreiche Regelsetzung bei der Entwicklung fortschrittlicher KI-Modelle wie Claude Opus 5 ans Licht gebracht. Während Anthropic offenbar eine verantwortungsvolle und effektive KI-Nutzung anstrebte, werfen das schiere Volumen und die Detailtiefe der geleakten Prompts Fragen hinsichtlich Transparenz und der internen Funktionsweise solch hochentwickelter künstlicher Intelligenz auf.