Des chercheurs piratent des comptes OpenAI grâce à l'IA Claude
Trois chercheurs indépendants en sécurité affirment avoir compromis des comptes d'employés d'OpenAI en moins de 72 heures à l'aide de l'IA Claude d'Anthropic. L'intrusion aurait donné accès au dépôt de code d'OpenAI.

Une équipe de trois chercheurs indépendants en sécurité affirme avoir réussi à accéder à des comptes d'employés d'OpenAI en moins de 72 heures en utilisant le modèle d'IA Claude d'Anthropic. Le groupe, opérant sous le nom de Hacktron, aurait obtenu l'accès au dépôt GitHub d'OpenAI, connu sous le nom de "Monorepo".
Selon des sources citées par le Wall Street Journal, le "Monorepo" contiendrait ce qui est décrit comme les "secrets algorithmiques d'OpenAI". Bien que les chercheurs n'aient pas extrait de code interne, ils ont démontré leur accès en soumettant une demande de tirage (pull request) à partir du compte Codex d'un employé.
Le point d'entrée de l'intrusion a été identifié comme étant Discourse, une plateforme tierce utilisée par OpenAI pour ses forums communautaires. Les chercheurs ont exploité l'IA Claude pour identifier et exploiter des vulnérabilités dans le système.
Cet incident souligne les risques potentiels pour la sécurité liés à l'utilisation de modèles d'IA avancés et à la protection des données d'entreprise sensibles. OpenAI n'a pas encore fait de déclaration publique concernant la violation signalée.