Tu suis la course aux modèles IA ?
Chaque sortie (GPT, Claude, Gemini, Mistral…) décryptée le soir même, en 5 min. Gratuit.
Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.
Choisis ton rythme
Gratuit · Pas de spam · Désabonnement en 1 clic
Anthropic et le défi des filigranes IA pour l'Europe
Dans un effort pour se conformer aux exigences de l'Union européenne, Anthropic s'engage à intégrer des filigranes invisibles dans les contenus générés par son intelligence artificielle. Cette initiative vise à rendre les textes et fichiers produits par ses modèles identifiables par des machines, conformément au règlement européen sur l'intelligence artificielle entré en vigueur le 2 août. Bien que l'entreprise ne garantisse pas l'indélébilité de ces marquages, l'objectif est de répondre aux attentes de Bruxelles.
Depuis l'entrée en vigueur de cette réglementation, environ 190 organisations, dont des géants comme Google, Mistral, Meta et OpenAI, ont adhéré au code de bonnes pratiques associé. Anthropic, la société mère du modèle Claude, a récemment publié un document détaillant comment elle prévoit de marquer ses contenus de manière invisible. Cette démarche s'inscrit dans un contexte où la transparence des contenus générés par IA devient cruciale.
Une technologie de marquage inspirée des billets de banque
Le concept de filigrane utilisé par Anthropic s'apparente à celui des fils de sécurité intégrés dans les billets de banque. Bien que ces marquages soient invisibles à l'œil nu, ils peuvent être détectés à l'aide d'outils appropriés. Lorsqu'un modèle Claude génère un texte, un motif statistique imperceptible est intégré dans les mots, sans qu'aucun logo ou mention visible ne soit ajouté.
Anthropic assure que ce procédé n'altère ni le sens ni la qualité des réponses générées. Le filigrane est conçu pour être résistant aux opérations de copier-coller et à certaines modifications mineures. Ce marquage sera appliqué à tous les niveaux du modèle, y compris dans les applications, les API, Claude Code, et chez les partenaires tels qu'AWS, Google Cloud et Microsoft Foundry. Notamment, le tatouage s'appliquera partout où Claude est proposé, pas seulement sur le sol européen, illustrant l'effet des régulations européennes à l'échelle mondiale.
Pour les fichiers générés, notamment les images aux formats .png, .jpg ou .svg, une approche différente est adoptée. Ces fichiers recevront des métadonnées de provenance signées numériquement, conformes au standard ouvert C2PA, déjà utilisé par des marques comme Leica, Sony, Nikon et Google Pixel. Le calendrier de mise en œuvre suit strictement les directives européennes, avec un déploiement immédiat pour les nouveaux modèles et une période de transition jusqu'au 2 décembre pour les modèles existants. De plus, des outils de détection ouverts aux tiers sont promis dans une documentation à venir, conformément aux exigences du code. L'article 50 prévoit des amendes pouvant atteindre 15 millions d'euros ou 3 % du chiffre d'affaires mondial pour les non-conformités.
Des approches variées parmi les géants de la technologie
Dans le domaine du marquage des contenus générés par IA, chaque entreprise adopte sa propre stratégie. Google, par exemple, utilise depuis 2024 sa technologie SynthID pour marquer les contenus de son modèle Gemini, et a déjà estampillé 100 milliards d'images et de vidéos. OpenAI, après avoir exploré le tatouage de texte, a finalement choisi d'adopter la technologie de filigrane de Google pour ses images.
Anthropic, quant à elle, opte pour une approche distincte en développant son propre filigrane texte intégré directement dans le modèle Claude. Cette décision contraste avec celles de ses concurrents qui ont soit externalisé la solution, soit décidé de ne pas la mettre en œuvre.
Les défis de la fiabilité du marquage
La fiabilité de ce procédé de marquage reste à prouver, comme l'indique Anthropic dans sa documentation. Un contenu marqué ne signifie pas nécessairement qu'il a été généré par Claude, car même un texte relu ou traduit par l'IA peut être estampillé. De plus, l'absence de marque ne garantit pas l'authenticité d'un contenu, car des modifications importantes ou une simple capture d'écran peuvent effacer le signal.
Des chercheurs ont déjà démontré que les filigranes d'images peuvent être supprimés, et rien n'indique que les textes seront plus résistants. Malgré ces incertitudes, pour les enseignants, recruteurs ou rédactions, disposer d'un détecteur officiel est préférable aux outils actuels, souvent peu fiables.
Pour Anthropic, afficher sa conformité aux régulations est un moyen de renforcer sa crédibilité, surtout après les récents changements de sa politique de confidentialité. Les utilisateurs pourront bientôt vérifier les textes suspects avec le détecteur de Claude, tout en gardant à l'esprit que l'entreprise elle-même ne garantit pas la fiabilité absolue de ce marquage.




