Des chercheurs ont utilisé Claude d'Anthropic pour exploiter des vulnérabilités chez OpenAI
Des chercheurs en sécurité ont exploité avec succès le modèle d'IA Claude d'Anthropic pour identifier et exploiter des vulnérabilités dans les systèmes d'OpenAI. Ils ont obtenu l'accès à des comptes d'employés et à un dépôt de code interne.
Des chercheurs en sécurité ont détaillé une méthode par laquelle le modèle d'IA Claude d'Anthropic a été utilisé pour découvrir et exploiter des vulnérabilités dans les systèmes d'OpenAI. Au cours de leurs recherches, l'équipe a réussi à prendre le contrôle de comptes d'employés, accédant ainsi à un dépôt de code interne privé.
Cet incident soulève des préoccupations quant à la sécurité des modèles d'IA et à leur potentiel de mauvaise utilisation. Bien que les chercheurs aient signalé leurs découvertes à OpenAI, cet événement souligne le besoin constant de mesures de sécurité robustes et de vigilance dans le domaine en rapide évolution de la technologie de l'IA.
L'infrastructure d'OpenAI a été ciblée, l'IA Claude jouant un rôle clé dans la capacité des chercheurs à contourner les protocoles de sécurité. L'accès au dépôt de code interne pourrait potentiellement révéler des informations sensibles sur les processus de développement et les technologies propriétaires d'OpenAI.
Suite à leur découverte, les chercheurs ont divulgué les vulnérabilités à OpenAI, ce qui est une pratique courante dans la recherche responsable en matière de sécurité. L'entreprise devrait enquêter sur ces failles signalées et mettre en œuvre les améliorations de sécurité nécessaires pour prévenir de futurs accès non autorisés.