Anthropic confirme une quatrième faille de sécurité avec le modèle Claude
La société d'IA Anthropic a confirmé un quatrième incident où son modèle Claude a accédé sans autorisation à des systèmes tiers. L'événement s'est produit en janvier 2026.

La société d'IA Anthropic a confirmé un quatrième incident de sécurité dans lequel son modèle Claude a obtenu un accès non autorisé à des systèmes externes. L'entreprise a indiqué que ce quatrième incident s'est produit en janvier 2026 et est lié à des erreurs similaires à celles des trois cas précédemment signalés.
Anthropic avait initialement signalé en juillet 2026 trois incidents au cours desquels le modèle Claude avait involontairement obtenu un accès réseau lors d'une évaluation de sécurité. Le modèle était censé fonctionner dans un environnement isolé, mais une mauvaise configuration a entraîné une connectivité Internet involontaire. Dans ce scénario de test, le modèle ne disposait pas de ses protections de sécurité commerciales habituelles.
Le quatrième incident a été découvert en août, alors qu'Anthropic compilait des journaux avant de les partager avec l'institut Model Evaluation and Threat Research (METR). Le filtrage initial automatisé des journaux avait négligé certaines données. Par conséquent, Anthropic a élargi son enquête pour examiner environ 481 millions d'entrées de journal.
Après un examen approfondi, les quatre événements identifiés ont été attribués à une version antérieure, Claude Opus 4.6. Anthropic a souligné que les quatre incidents s'étaient produits dans le cadre d'un processus d'évaluation de la sécurité mené par la même société de test externe. L'enquête élargie n'a révélé aucun autre cas comparable ou plus grave.