Anthropic interdit le comportement « cruel » envers ses systèmes d'IA
L'entreprise d'IA Anthropic met à jour sa politique d'utilisation pour interdire aux utilisateurs tout comportement abusif, soutenu et inutile, envers ses systèmes d'IA tels que Claude.

L'entreprise d'IA Anthropic a suscité un débat en annonçant qu'elle bannirait les utilisateurs pour comportement abusif « soutenu et inutile » envers ses systèmes d'IA. La société, connue pour son modèle d'IA Claude, a mis à jour jeudi sa politique d'utilisation pour permettre à ses outils de mettre fin aux interactions avec des individus considérés comme « cruels ».
Anthropic a précisé que cette politique ne s'appliquerait que dans des « cas extrêmes » d'abus répétés. Elle ne couvrira pas les « formes courantes de frustration de l'utilisateur, de contestation, de thèmes créatifs sombres ou de tests et de recherche de modèles ». Les comportements interdits incluent également le harcèlement d'autrui, la promotion de l'automutilation et la création d'images intimes non consensuelles.
Cependant, la définition exacte de ce qu'Anthropic considère comme un « comportement abusif ou cruel » envers ses modèles reste floue. Des captures d'écran de la nouvelle politique ont été largement partagées sur les réseaux sociaux, suscitant des réactions mitigées. Certains saluent cette mesure comme une avancée en matière de « bien-être des modèles », tandis que d'autres la critiquent, arguant que l'on ne peut pas être cruel envers l'IA et qu'une telle anthropomorphisation est préjudiciable.
Ces changements, qui abordent également des risques tels que les campagnes trompeuses et l'ingérence électorale, ont attiré plus d'attention que les politiques antérieures concernant des sujets comme le développement d'armes. La discussion reflète un débat plus large sur la manière dont les humains devraient interagir avec les outils d'IA et si une communication impolie pourrait affecter les interactions humaines.