Brief IA : Anthropic accuse des géants chinois de 190 millions d’attaques

Anthropic accuse des géants chinois de 190 millions d’attaques

Brief IA
Tom Levy·3 min·0 vues

Anthropic accuse plusieurs laboratoires chinois d'avoir mené près de 190 millions d'attaques de distillation sur Claude entre mai et juillet L'entreprise détaille des détournements massifs de requêtes, impliquant notamment Alibaba, Moonshot, DeepSeek, Zhipu et Xiaomi Des données sensibles liées à des gouvernements et militaires chinois et russes auraient été exposées.

En bref
1Anthropic accuse plusieurs laboratoires chinois d'avoir mené près de 190 millions d'attaques de distillation sur Claude entre mai et juillet
2L'entreprise détaille des détournements massifs de requêtes, impliquant notamment Alibaba, Moonshot, DeepSeek, Zhipu et Xiaomi
3Des données sensibles liées à des gouvernements et militaires chinois et russes auraient été exposées
4Anthropic annonce des mesures techniques et des vérifications d'identité ciblées
💡Pourquoi c'est importantCes accusations illustrent l'ampleur des risques de détournement de modèles avancés et la réponse technique d'un acteur majeur du secteur.
Le brief IA que lisent les pros

Tu suis la course aux modèles IA ?

Chaque sortie (GPT, Claude, Gemini, Mistral…) décryptée le soir même, en 5 min. Gratuit.

Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.

Choisis ton rythme

Gratuit · Pas de spam · Désabonnement en 1 clic

📄
L'analyse en français

Anthropic dit avoir subi près de 190 millions d’attaques de distillation entre mai et juillet, menées par plusieurs laboratoires chinois. L’entreprise évoque des détournements massifs de requêtes vers Claude, des données sensibles exposées et annonce des garde-fous techniques et des vérifications d’identité ciblées.

Données sensibles exposées et volume record attribué à Alibaba

Anthropic rapporte que des requêtes destinées à des modèles chinois mais redirigées vers Claude ont exposé des informations sensibles liées à des autorités chinoises et russes. L’entreprise cite des vidéos de surveillance téléchargées par un utilisateur affilié à l’Armée populaire de libération et des éléments sur une base de données gouvernementale russe soumis par un entrepreneur militaire russe. Parallèlement, Anthropic attribue à Alibaba la plus grande attaque qu’elle ait mesurée, avec plus de 151 millions d’échanges entre mai et juillet, opérés par 3 500 comptes frauduleux. Selon Anthropic, ces comptes ont amené Claude à détailler ses processus de raisonnement, ensuite exploités pour entraîner les modèles Qwen.

Qui est visé et comment les requêtes auraient été détournées

Anthropic affirme que DeepSeek et Moonshot AI ont redirigé des requêtes d’utilisateurs vers Claude plutôt que vers leurs propres systèmes. L’entreprise dit avoir comptabilisé 23 millions de redirections pour Moonshot entre mai et juillet, et 12,1 millions pour DeepSeek sur 14 jours en juillet. Anthropic accuse aussi Z.ai, lié au modèle Ox Alpha, d’une attaque similaire à celle imputée à Alibaba, et affirme que Xiaomi a enregistré des conversations issues de ses modèles MiMo pour les injecter dans Claude afin de générer des données d’entraînement. Au cœur de ces pratiques, la distillation consiste à s’appuyer sur les sorties d’un modèle plus avancé pour améliorer un modèle plus simple. Au total, Anthropic évalue à au moins 35 millions les redirections de requêtes opérées durant l’été par de grands laboratoires chinois.

Ce que change Anthropic dans Claude et l’accès au service

Pour prévenir de nouvelles campagnes, Anthropic dit avoir instauré des mécanismes de détection et d’interdiction d’activités suspectes. L’entreprise explique avoir ajusté Claude pour qu’il produise des transcriptions de raisonnement moins détaillées, jugées moins exploitables pour l’entraînement de tiers. Elle prévoit aussi d’exiger une vérification d’identité des utilisateurs semblant opérer depuis la Chine, la Russie ou l’Iran, des pays où le service n’est pas disponible.

Antécédents publics et bilan chiffré de la période

Entre mai et juillet, Anthropic avance un total proche de 190 millions d’attaques de distillation attribuées à Alibaba, Moonshot, DeepSeek, Zhipu et Xiaomi. L’entreprise décrit un bombardement de requêtes durant l’été et met en cause plusieurs acteurs chinois. Elle rappelle avoir déjà interpellé publiquement ces laboratoires par le passé. En juin, Sarah Heck, responsable des politiques chez Anthropic, a indiqué dans un courrier aux législateurs qu’Alibaba aurait mené illicitement 28,8 millions d’échanges avec Claude entre le 22 avril et le 5 juin, appelant à une intervention législative.

Suivez Brief IA

L'actu IA du jour, aussi dans votre fil.

Commentaires