Anthropic intègre des filigranes invisibles aux créations IA de Claude

Le brief IA que les pros lisent chaque soir
Les 7 actus IA du jour, décryptées en 5 min. Gratuit.
Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.
Choisis ton rythme
Gratuit · Pas de spam · Désabonnement en 1 clic
Anthropic intègre des filigranes invisibles aux créations IA de Claude
Anthropic a annoncé qu'il commencera à marquer les textes et images générés par Claude avec des données lisibles par machine, dans le but de se conformer aux règles européennes sur la transparence de l'IA. « Les textes générés porteront des filigranes intégrés, et les fichiers générés incluront des métadonnées de provenance signées numériquement lorsque cela est pris en charge », indique Anthropic sur une nouvelle page de support de Claude. Ces changements sont invisibles à l'œil nu, mais faciliteront la détection du contenu généré par les modèles Claude par les utilisateurs et les plateformes en ligne.
Ces mises à jour représentent un engagement futur plutôt qu'une mise en œuvre immédiate. Les nouvelles obligations de marquage et de transparence de l'IA en vertu de la loi européenne sur l'IA, entrée en vigueur le 2 août, incluent une période de grâce de quatre mois pour la conformité des produits d'IA existants lancés avant cette date. Ainsi, Anthropic précise que les nouveaux modèles Claude marqueront le contenu généré par l'IA dès leur sortie, mais le soutien pour ses modèles existants est encore en cours de développement.
Les marques lisibles par machine seront appliquées à l'échelle mondiale aux modèles Claude pris en charge, y compris Claude Platform (API), Claude, Claude Code, Claude Cowork et Claude Tag. Deux techniques de marquage différentes sont utilisées : pour les images traitées par Claude, le standard de métadonnées de provenance C2PA — déjà adopté par Adobe, OpenAI et Google — sera appliqué aux fichiers pris en charge, mais le processus de marquage des textes générés par Claude est moins détaillé.
Selon Anthropic, un « filigrane imperceptible » est tissé directement dans le texte généré par les modèles Claude sans altérer le sens, la qualité ou la lisibilité de la réponse du chatbot. Anthropic ne nomme pas ce système de filigranage, mais précise que ces filigranes textuels seront également appliqués lorsque les modèles Claude sont accessibles via AWS, Google Cloud ou Microsoft Foundry.
« Parce que le filigrane fait partie du texte, il voyagera avec le texte lorsqu'il est copié et collé ailleurs, et peut persister à travers certaines modifications », indique Anthropic sur la page de support de Claude. « Le filigranage sera appliqué au niveau du modèle, ce qui signifie qu'il sera présent peu importe le produit ou la surface Claude d'où provient le texte. »
Anthropic travaille également à permettre aux utilisateurs et à d'autres tiers de détecter les filigranes et les métadonnées de provenance intégrés dans le contenu généré par Claude, et annonce qu'il partagera des détails sur ce système de détection dans une documentation technique à venir. Plusieurs outils sont déjà disponibles pour détecter les métadonnées C2PA, y compris le chatbot Gemini de Google, mais il n'est pas clair si ceux-ci fonctionneront avec les fichiers générés par Claude. J'ai demandé des éclaircissements à Anthropic.
C'est une autre étape vers un marquage clair des textes et images générés par l'IA sur les plateformes en ligne, et une victoire potentielle pour ceux qui souhaitent éviter de consommer ce type de contenu. Les lecteurs de fanfiction ont déjà commencé à construire des systèmes de détection plus rudimentaires pour signaler quand les outils Claude ont été utilisés dans les œuvres de fan sur AO3, mais ces systèmes de marquage peuvent être appliqués de manière beaucoup plus large — si tant est qu'ils fonctionnent.
Les données C2PA sont connues pour être facilement supprimées, parfois même accidentellement lorsque les médias qui les portent sont téléchargés sur des plateformes en ligne, et il n'est pas clair à quel point la solution de filigranage textuel d'Anthropic est robuste. Même la société elle-même admet que ces systèmes de marquage sont loin d'être infaillibles, et que tout contenu dépourvu de marques détectables pourrait tout de même provenir de modèles d'IA générative.
Brief IA — L'actualité IA en français
L'essentiel de l'actualité de l'intelligence artificielle, décrypté et expliqué chaque jour.