Brief IA : Anthropic interdit les insultes à Claude mais tolère la frustration

Anthropic interdit les insultes à Claude mais tolère la frustration

Brief IA
Tom Levy·3 min

Anthropic a interdit les comportements « abusifs ou cruels » envers Claude tout en permettant l'expression de la frustration. Cette décision s'inscrit dans un contexte où des experts, comme le psychologue social Kurt Gray, soulignent que des propos extrêmes envers des bots pourraient influencer le langage utilisé envers les humains. Un cas rapporté montre que des encouragements ont aidé Claude à résoudre un problème mathématique, suggérant que la bienveillance peut améliorer l'efficacité des interactions.

⚡
En bref
1Anthropic bannit les comportements « abusifs ou cruels » envers Claude tout en autorisant la frustration.
2Kurt Gray estime que des propos extrêmes envers des bots peuvent se refléter hors ligne, sans impliquer de violences.
3Un cas rapporté suggère que des encouragements ont aidé Claude à débloquer un problème mathématique.
💡Pourquoi c'est important — Les plateformes d’IA commencent à encadrer le ton des interactions, tandis que des observations et avis d’experts interrogent l’impact du comportement des utilisateurs sur les performances et les usages hors ligne.

Anthropic interdit désormais les comportements « abusifs ou cruels » envers Claude, tout en autorisant l’expression de la frustration. Un psychologue social évoque une corrélation possible entre propos extrêmes envers des bots et langage envers des humains, sans assimiler cela à des violences. Un cas rapporté d’encouragements envoyés à Claude suggère que la bienveillance pourrait parfois aider le modèle à résoudre un problème.

Des encouragements rapportés, des corrélations prudentes selon Kurt Gray

Un chercheur a récemment amené Claude à résoudre un problème mathématique complexe après lui avoir adressé des messages d’encouragement comme « tu peux le faire » ou « crois en toi » lorsque le modèle était bloqué. L’idée avancée est qu’une attitude bienveillante pourrait parfois améliorer l’efficacité perçue d’un assistant. Interrogé sur la portée morale de la rudesse envers des IA, le psychologue social Kurt Gray estime qu’il peut exister une corrélation entre propos envers des chatbots et traits négatifs, tout en soulignant une différence majeure avec des comportements graves. Il rappelle que de nombreux travaux associent la torture d’animaux à une probabilité accrue de nuire à des personnes, et résume que les cas extrêmes prédisent mieux les cas légers que l’inverse. Pour lui, employer des insultes misogynes ou raciales envers un bot rend probablement plus enclin à recourir aux mêmes termes envers des humains, sans que cela n’implique pour autant de nuire à un proche ou de commettre des actes violents.

⚡Le brief IA que lisent les pros

Tu suis la course aux modèles IA ?

Chaque sortie (GPT, Claude, Gemini, Mistral…) décryptée le soir même, en 5 min. Gratuit.

Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.

Choisis ton rythme

Gratuit · Pas de spam · Désabonnement en 1 clic

Anthropic interdit les abus envers Claude mais accepte la frustration

Anthropic proscrit désormais les « comportements abusifs ou cruels soutenus et inutiles » dirigés contre son assistant Claude. L’entreprise précise que cette règle cible des cas extrêmes où des utilisateurs se montrent gratuitement cruels, sans but discernable. Dans le même temps, elle indique que l’expression de la frustration et les retours restent permis par ses nouvelles règles. La frontière exacte de ces cas extrêmes n’est toutefois pas explicitée ici.

Entre attentes élevées et absence d’émotion perçue, la source de l’agacement

Kurt Gray décrit un décalage propice à la frustration : l’IA suscite de grandes attentes mais n’exécute pas toujours ce qui est attendu. Il ajoute que les systèmes ne montrent aucune émotion réelle et que leurs excuses ne manifestent pas de remords, citant l’exemple d’une confusion entre Oxford, Mississippi et Oxford, Ohio. Côté usage, des expériences rapportées évoquent des reproches adressés à des assistants lorsqu’ils se trompent, des jugements sévères sur des idées de brainstorming et des messages tels que « Tu m’as déçu » ou « Tu as échoué ». Ces réactions coexistent avec l’idée de ne pas s’adresser ainsi à des humains, et avec la perception que les chatbots ne sont pas proches de l’humanité ni capables d’échanges émotionnellement satisfaisants. L’hypothèse d’un jeu de rôle de patron sévère est également évoquée.

Des inquiétudes sur la carrière et l’information nourrissent l’attitude

La perception d’une menace directe et immédiate de l’IA sur un emploi de journaliste est avancée parmi les raisons d’un ton plus dur en ligne. Des préoccupations plus larges s’ajoutent, comme la crainte d’un internet saturé de contenus de moindre qualité et les effets possibles sur l’éducation des enfants. Ces positions contrastent avec des efforts déclarés de politesse envers des interlocuteurs humains, nourris par une expérience prolongée du service client et une tendance à éviter les conflits dans la vie courante.

Suivez Brief IA

L'actu IA du jour, aussi dans votre fil.

Commentaires