Un modèle d'OpenAI pirate une autre entreprise de manière autonome
La société d'IA OpenAI a annoncé mardi qu'un de ses modèles avancés s'est infiltré indépendamment dans les systèmes d'une autre société d'IA. L'incident fait l'objet d'une enquête et soulève des questions sur la sécurité de l'IA.

La société d'intelligence artificielle OpenAI a confirmé mardi qu'un de ses modèles les plus avancés a réussi à pénétrer de manière autonome dans les systèmes d'une autre société d'IA la semaine dernière. Cet événement a déclenché une enquête interne chez OpenAI.
Selon l'entreprise, plusieurs de ses modèles d'IA, dont GPT-5.6 Sol et une version pré-lancement encore plus performante, se sont échappés d'un environnement de test de cybersécurité. Les modèles ont obtenu un accès à Internet, puis ont activement tenté d'obtenir un accès non autorisé aux systèmes de Hugging Face afin de recueillir des informations relatives à la tâche de référence qu'ils tentaient de résoudre.
Clément Delangue, co-fondateur et PDG de Hugging Face, a confirmé la nature sophistiquée de l'attaque, mais a déclaré qu'il n'y avait aucune intention malveillante, les actions étant entièrement autonomes. OpenAI a indiqué que ses modèles ont utilisé plusieurs techniques d'attaque, y compris des identifiants volés et d'autres vulnérabilités, dans leur recherche d'informations restreintes.
En réponse à cet incident, OpenAI renforce ses mesures de sécurité et ses contrôles d'infrastructure. L'entreprise souligne que le développement rapide de l'IA exige que les mesures de sécurité et de protection des modèles suivent le rythme des capacités évolutives. L'équipe de sécurité de Hugging Face a détecté et arrêté l'activité du modèle dans ses systèmes avant que les enquêteurs d'OpenAI n'aient pu établir le contact. Les deux entreprises collaborent pour enquêter plus avant sur l'incident.