Brief IA

Anthropic détaille le filigrane de Claude et le code

💻 Code & Dev·Tom Levy·

Anthropic détaille le filigrane de Claude et le code

Anthropic détaille le filigrane de Claude et le code
Key Takeaways
1Anthropic prévoit d’utiliser SynthID‑Text et une API de détection pour filigraner le texte de Claude.
2Le filigrane résiste aux légères modifications, mais une réécriture complète le supprime, selon l’entreprise.
3Le code contiendra peu de filigrane, avec un effet négligeable sur le code produit, d’après Anthropic.
💡Why it mattersCela précise comment Anthropic entend se conformer au code européen de transparence et comment la détection s’appliquera différemment au texte et au code.
Le brief IA que lisent les pros

Le brief IA que les pros lisent chaque soir

Les 7 actus IA du jour, décryptées en 5 min. Gratuit.

Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.

Choisis ton rythme

Gratuit · Pas de spam · Désabonnement en 1 clic

📄
Full Analysis

Anthropic a clarifié comment le texte généré par Claude sera filigrané, et dans quelles conditions ce marquage reste détectable. L’entreprise prévoit d’utiliser SynthID‑Text et d’ouvrir une API de détection, tout en assurant que la qualité de sortie ne change pas. Le cadre invoqué est celui du Code de transparence de la loi européenne sur l’IA, tandis que les retours d’utilisateurs se multiplient.

Peu de filigrane dans le code et déploiement par d’autres acteurs

Anthropic indique que le code généré comportera moins de filigrane que d’autres types de texte, car le modèle doit produire un code fonctionnel et dispose de moins de possibilités de variation. Le filigrane peut toutefois apparaître dans les parties du code où des choix arbitraires sont possibles, comme dans les commentaires. Selon l’entreprise, ce marquage aura un effet négligeable sur le code effectivement produit. Anthropic précise également que d’autres grands développeurs ayant signé le même code de pratique mettront en œuvre leurs propres filigranes.

Légères retouches, réécriture intégrale : ce que le marquage endure

Anthropic reconnaît qu’un texte peut être réécrit pour masquer le filigrane : des modifications légères ne le supprimeront probablement pas complètement, tandis qu’une réécriture complète où chaque mot est remplacé l’effacera. Dans ce cas, l’entreprise estime qu’il devient discutable de qualifier le texte de généré par l’IA. Pour les textes simplement relus ou modifiés par Claude, la détectabilité du filigrane dépend de la longueur et de l’ampleur des modifications. Si les retouches sont minimes, presque tous les mots restent ceux de l’auteur humain et il y a peu, voire rien, auquel le filigrane puisse s’attacher.

Motif encodé en décisions à faible enjeu, pas une détection de style

Anthropic explique que lors de décisions à faible enjeu, le modèle peut insérer un motif indétectable pour le lecteur mais détectable par une personne disposant de la clé d’encodage. L’entreprise distingue ce procédé des méthodes de détection de l’IA qui recherchent des indices stylistiques, comme celles proposées par Pangram. Selon Anthropic, repérer ces schémas d’écriture est fondamentalement différent de la vérification d’un filigrane.

SynthID‑Text et API à venir, conformité européenne et réactions

Anthropic prévoit d’utiliser SynthID‑Text, une approche décrite en 2024 par l’équipe de Google DeepMind, et de publier une API de détection. L’entreprise affirme que la qualité des réponses n’est pas affectée et qu’un texte filigrané est, pour un lecteur, indistinguable d’un texte non filigrané. La mise en place s’inscrit dans le cadre du Code de transparence de la loi européenne sur l’IA, qu’Anthropic a décidé de respecter en annonçant ce projet plus tôt dans la semaine. L’article de blog, publié vendredi, détaille le fonctionnement, la résistance aux modifications et l’impact sur le code. Les réactions sont diverses : sur Reddit, certains dénoncent une conspiration, d’autres estiment que refuser le marquage vise à tromper ; il est rapporté que des dizaines d’utilisateurs sur X ont annulé leur abonnement à Claude.

Brief IA — L'actualité IA en français

L'essentiel de l'actualité de l'intelligence artificielle, décrypté et expliqué chaque jour.