Les instructions système de Claude Opus 5 ont fuité en ligne
Les instructions système du dernier modèle d'IA d'Anthropic, Claude Opus 5, auraient fuité en ligne. Ces directives détaillées régissant le comportement du modèle ont été publiées sur GitHub peu après le lancement.

Selon des informations provenant du site d'information technologique IT Home, le dernier modèle d'IA d'Anthropic, Claude Opus 5, aurait été victime d'une fuite de données significative. Les instructions système, qui constituent le cœur des directives régissant le fonctionnement de l'IA, auraient été publiées sur GitHub peu après le lancement du modèle Opus 5.
Les données divulguées comprennent plus de 13 500 caractères et environ 19 000 mots anglais, formant les instructions système fondamentales du modèle. Une analyse de ces instructions révèle un document multifacette qui inclut des directives détaillées pour l'utilisation des outils de l'IA, le respect des directives légales et éthiques, ainsi que des consignes pour la promotion de ses propres services.
Les instructions sont structurées en trois catégories principales : un manuel produit détaillant plus de 30 outils, tels que des interfaces en ligne de commande et des capacités d'extraction de données web ; un guide juridique et de conformité décrivant les règles relatives aux droits d'auteur, à la sécurité des enfants et à la neutralité politique ; et un canal de promotion des propres produits d'Anthropic, tels que Claude Code et Cowork.
Une partie importante des informations divulguées concerne les fonctions de mémoire du modèle. Le système comprend des protocoles stricts sur les données utilisateur qui peuvent être stockées et comment, soulignant que seules les déclarations explicites de l'utilisateur doivent être enregistrées. Les instructions limitent également la manière dont l'IA peut faire référence à ses propres suggestions ou aux informations fournies par l'utilisateur, dans le but d'éviter la création de souvenirs irréalistes ou un sentiment de dépendance anthropomorphique.
La fuite a mis en lumière la conception complexe et la définition exhaustive des règles impliquées dans le développement de modèles d'IA avancés comme Claude Opus 5. Bien qu'Anthropic ait apparemment visé un fonctionnement responsable et efficace de l'IA, le volume et le niveau de détail des instructions divulguées soulèvent des questions sur la transparence et le fonctionnement interne de telles intelligences artificielles sophistiquées.