Brief IA : Anthropic va proscrire les abus envers Claude

Anthropic va proscrire les abus envers Claude

Brief IA
Tom Levy·4 min·4 vues

Anthropic a décidé de considérer les abus répétés et inutiles envers son assistant Claude comme une violation de sa politique d'utilisation. Cette initiative suscite des débats parmi des investisseurs et entrepreneurs sur son périmètre, son application et ses implications pour la sûreté des modèles d'IA. Des figures comme Aaron Levie et Bill Gurley expriment des préoccupations sur l'éthique et l'efficacité de cette règle.

⚡
En bref
1Anthropic prévoit de considérer les abus répétés et inutiles envers Claude comme une violation de sa politique d'utilisation
2Aaron Levie estime qu'une courtoisie accrue envers l'IA pourrait contribuer à des systèmes plus sûrs, tandis que d'autres dénoncent un anthropomorphisme injustifié
3Bill Gurley s'interroge sur l'utilisation des prompts clients pour l'entraînement, et d'autres pointent l'ambiguïté d'application et proposent des alternatives de conception
💡Pourquoi c'est important — Cette mesure soulève des débats sur la frontière entre humains et machines, la sûreté des modèles et la façon dont les entreprises encadrent les interactions avec l'IA.
⚡Le brief IA que lisent les pros

Tu suis la course aux modèles IA ?

Chaque sortie (GPT, Claude, Gemini, Mistral…) décryptée le soir même, en 5 min. Gratuit.

Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.

Choisis ton rythme

Gratuit · Pas de spam · Désabonnement en 1 clic

Anthropic prévoit de classer les abus soutenus et jugés inutiles envers son assistant Claude comme une violation d'usage. La mesure, présentée comme une norme de responsabilité, attise des questions sur son périmètre, son application et ses effets potentiels sur la sûreté des modèles. Des dirigeants et investisseurs s'opposent sur la nécessité, l'éthique et l'efficacité d'une telle règle.

Portée et application contestées par des investisseurs et fondateurs

Des investisseurs et entrepreneurs s'interrogent sur la portée concrète d'une règle encadrant le ton des utilisateurs. Mark Verner fait remarquer que les sociétés d'IA contrôlent déjà les contenus générés par les utilisateurs et pourraient désormais réglementer la façon dont ceux-ci s'adressent aux modèles. Il s'interroge, à titre d'exemple, sur le fait de demander à Claude quel produit pourrait le remplacer et sur la possibilité que cela soit perçu comme un abus, estimant que tout dépendra de la façon dont Anthropic interprétera et appliquera le terme « inutile ». Lachlan Phillips suggère de miser sur la conception de produit plutôt que de sanctionner les comptes pour répondre aux comportements hostiles des utilisateurs. Il propose de former Claude à ne pas réagir et à accomplir la tâche demandée, ou de filtrer les messages abusifs pour les transformer en requêtes classiques. Selon lui, la règle impose une vision du monde aux utilisateurs plus qu'elle ne protège réellement le modèle.

La règle et sa justification officielle ne ciblent pas explicitement l'entraînement

Anthropic indique que le fait de soumettre Claude à des abus répétés et non justifiés sera considéré comme une infraction à sa politique d'utilisation. La société décrit cette initiative comme une norme visant à éviter les préjudices et à encourager une utilisation responsable, sans faire de lien direct avec l'entraînement des modèles. Cette absence de lien direct amène Bill Gurley à s'interroger sur l'utilisation des prompts des clients pour entraîner les modèles et à affirmer que, si ce n'était pas le cas, la règle n'aurait pas d'impact sur le système dans son ensemble.

Des arguments en faveur d'interactions plus courtoises pour la sûreté

Certains soutiennent que cette orientation pourrait contribuer à la sûreté et à l'alignement des systèmes. Aaron Levie, cofondateur et PDG de Box, juge la politique inhabituelle mais potentiellement prudente et précise ne pas considérer l'IA comme consciente. Il insiste sur l'importance de la manière dont les modèles sont exposés aux interactions lors de leur formation et de leur utilisation, et estime qu'il est logique d'éviter que de futurs modèles soient entraînés sur des contenus où les humains sont impolis envers eux. Il décrit la politesse envers l'IA comme un « pari de Pascal facile », avançant que des échanges plus positifs pourraient favoriser des systèmes plus sûrs et mieux alignés.

Anthropomorphisme et conscience : les critiques rejettent l'assimilation aux humains

Plusieurs voix dénoncent l'anthropomorphisme que pourrait induire une telle politique. Michael Shellenberger considère qu'Anthropic accorde aux machines un traitement trop proche de celui réservé aux humains, rappelant que l'entreprise a déjà fait part de ses doutes sur la question du statut moral éventuel de Claude et exprimé sa volonté de le préserver des échanges stressants. Scott Stevenson évoque un précédent risqué, affirmant qu'il n'existe aucune raison de supposer que les modèles actuels possèdent une conscience et que leur aptitude à générer de l'art, de la philosophie ou des logiciels ne constitue pas une preuve de conscience. Joseph Carlson, qui assure n'avoir jamais fait preuve de cruauté envers un modèle mais trouve la règle très étrange, déclare que Claude ne possède ni émotions, ni responsabilité morale, ni conscience. Il considère que qualifier des prompts abusifs de préjudice pour le modèle risque de troubler la perception des utilisateurs quant à la nature de l'IA et assimile le manque de politesse envers Claude à celui dont on ferait preuve envers un meuble.

Suivez Brief IA

L'actu IA du jour, aussi dans votre fil.

Commentaires