Watermarking IA : des tests révèlent des effets sur la sécurité
Des tests de Lasso Security révèlent que le watermarking SynthID-Text altère les réponses de six modèles d'IA face à des requêtes nuisibles, augmentant la probabilité de réponses à des demandes auparavant refusées. Ces résultats soulignent des implications critiques pour la sécurité des systèmes d'IA, notamment dans le cadre des nouvelles régulations européennes.
Avec l'accélération du déploiement du watermarking sous pression réglementaire européenne, ces résultats arrivent à un moment où la sécurité des IA est primordiale pour les entreprises.
Les professionnels tech doivent réévaluer la sécurité de leurs modèles d'IA face à des requêtes nuisibles, en tenant compte des effets du watermarking sur les réponses.
“Le watermarking pourrait affaiblir la sécurité des modèles d'IA face aux attaques.”
👥 Pour : CTO, chercheurs en IA, responsables de la sécurité, développeurs de modèles d'IA
Lire l'article complet