OpenAI lance un benchmark pour l'IA dans la santé mentale
La société d'IA OpenAI a lancé MentalHealthBench, un benchmark ouvert destiné à évaluer les réponses des systèmes d'IA dans des conversations relatives à la santé mentale.

La société d'intelligence artificielle OpenAI a annoncé le 23 septembre le lancement de MentalHealthBench, un benchmark ouvert conçu pour évaluer les performances des systèmes d'IA dans les conversations sur la santé mentale. L'outil vise à tester la manière dont l'IA réagit à des scénarios réalistes, allant des discussions non aiguës aux situations d'urgence.
OpenAI a précisé que ce benchmark a été co-créé avec plus de 80 professionnels agréés de la santé mentale issus de 22 pays. Il utilise des données de conversation synthétiques couvrant un éventail de situations, incluant des échanges avec des adultes et des adolescents, des interactions avec des aidants et des contextes cliniques, et ce, dans plusieurs langues et régions.
L'entreprise a utilisé un système de notation automatisé, GPT-5.6 Sol, pour évaluer les réponses des modèles d'IA selon des critères définis par les experts. Une étude parallèle menée auprès de 44 adultes dans 16 pays ayant utilisé l'IA pour un soutien émotionnel a révélé des priorités divergentes. Les utilisateurs ont davantage valorisé le ton et les conseils pratiques, tandis que les experts ont mis l'accent sur la collecte de contexte et l'interprétation minutieuse des ambiguïtés.
Cette initiative s'inscrit dans le prolongement des récents efforts d'OpenAI pour renforcer les réponses de l'IA dans les conversations sensibles et introduire des fonctionnalités telles que Trusted Contact dans ChatGPT. Le lancement intervient également dans un contexte de surveillance réglementaire accrue des outils numériques de santé mentale et de défis juridiques concernant l'impact de l'IA.