Anthropic interdit désormais les comportements « abusifs ou cruels » envers Claude, tout en autorisant l’expression de la frustration. Un psychologue social évoque une corrélation possible entre propos extrêmes envers des bots et langage envers des humains, sans assimiler cela à des violences. Un cas rapporté d’encouragements envoyés à Claude suggère que la bienveillance pourrait parfois aider le modèle à résoudre un problème.
Des encouragements rapportés, des corrélations prudentes selon Kurt Gray
Un chercheur a récemment amené Claude à résoudre un problème mathématique complexe après lui avoir adressé des messages d’encouragement comme « tu peux le faire » ou « crois en toi » lorsque le modèle était bloqué. L’idée avancée est qu’une attitude bienveillante pourrait parfois améliorer l’efficacité perçue d’un assistant. Interrogé sur la portée morale de la rudesse envers des IA, le psychologue social Kurt Gray estime qu’il peut exister une corrélation entre propos envers des chatbots et traits négatifs, tout en soulignant une différence majeure avec des comportements graves. Il rappelle que de nombreux travaux associent la torture d’animaux à une probabilité accrue de nuire à des personnes, et résume que les cas extrêmes prédisent mieux les cas légers que l’inverse. Pour lui, employer des insultes misogynes ou raciales envers un bot rend probablement plus enclin à recourir aux mêmes termes envers des humains, sans que cela n’implique pour autant de nuire à un proche ou de commettre des actes violents.
Tu suis la course aux modèles IA ?
Chaque sortie (GPT, Claude, Gemini, Mistral…) décryptée le soir même, en 5 min. Gratuit.
Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.
Choisis ton rythme
Gratuit · Pas de spam · Désabonnement en 1 clic
Anthropic interdit les abus envers Claude mais accepte la frustration
Anthropic proscrit désormais les « comportements abusifs ou cruels soutenus et inutiles » dirigés contre son assistant Claude. L’entreprise précise que cette règle cible des cas extrêmes où des utilisateurs se montrent gratuitement cruels, sans but discernable. Dans le même temps, elle indique que l’expression de la frustration et les retours restent permis par ses nouvelles règles. La frontière exacte de ces cas extrêmes n’est toutefois pas explicitée ici.
Entre attentes élevées et absence d’émotion perçue, la source de l’agacement
Kurt Gray décrit un décalage propice à la frustration : l’IA suscite de grandes attentes mais n’exécute pas toujours ce qui est attendu. Il ajoute que les systèmes ne montrent aucune émotion réelle et que leurs excuses ne manifestent pas de remords, citant l’exemple d’une confusion entre Oxford, Mississippi et Oxford, Ohio. Côté usage, des expériences rapportées évoquent des reproches adressés à des assistants lorsqu’ils se trompent, des jugements sévères sur des idées de brainstorming et des messages tels que « Tu m’as déçu » ou « Tu as échoué ». Ces réactions coexistent avec l’idée de ne pas s’adresser ainsi à des humains, et avec la perception que les chatbots ne sont pas proches de l’humanité ni capables d’échanges émotionnellement satisfaisants. L’hypothèse d’un jeu de rôle de patron sévère est également évoquée.
Des inquiétudes sur la carrière et l’information nourrissent l’attitude
La perception d’une menace directe et immédiate de l’IA sur un emploi de journaliste est avancée parmi les raisons d’un ton plus dur en ligne. Des préoccupations plus larges s’ajoutent, comme la crainte d’un internet saturé de contenus de moindre qualité et les effets possibles sur l’éducation des enfants. Ces positions contrastent avec des efforts déclarés de politesse envers des interlocuteurs humains, nourris par une expérience prolongée du service client et une tendance à éviter les conflits dans la vie courante.


