Anthropic : 151 millions d’échanges attribués à Alibaba

Le brief IA que les pros lisent chaque soir
Les 7 actus IA du jour, décryptées en 5 min. Gratuit.
Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.
Choisis ton rythme
Gratuit · Pas de spam · Désabonnement en 1 clic
Anthropic affirme avoir repéré cinq campagnes de distillation visant Claude, totalisant près de 200 millions d’échanges. Selon la société, la plus volumineuse est attribuée à Alibaba, tandis qu’une autre, imputée à Moonshot AI, aurait ciblé surtout Opus via des milliers de comptes. Des techniques ont été conçues pour forcer la divulgation de chaînes de pensée que l’entreprise n’expose pas normalement.
Alibaba attribué à 151 millions d’échanges en mai-juillet 2026
Anthropic indique avoir attribué à Alibaba la majorité des tentatives de distillation, qualifiant cet ensemble de « plus grand effort de distillation de gros » jamais observé par la société. Entre mai et juillet 2026, l’entreprise dit avoir comptabilisé 151 millions d’échanges liés à cette campagne, avec un pic proche de trois millions par jour. Les requêtes étaient réparties sur 3 500 comptes partageant un prompt fixe d’extraction de chaîne de pensée, ce qui a conduit Anthropic à y voir un effort unique pour produire du matériel d’entraînement destiné à la famille de modèles Qwen.
Moonshot AI aurait ciblé Opus via 5 000 comptes sur 10 jours
Anthropic attribue une autre campagne à Moonshot AI, fabricant de Kimi, en précisant qu’elle semblait véhiculer des demandes en provenance de l’armée chinoise. L’entreprise cite par exemple une requête visant l’évaluation de vidéos de surveillance pour détecter un comportement anormal. Sur une période de 10 jours, elle fait état de près de 300 000 demandes transmises à Claude via un maillage d’environ 5 000 comptes, visant principalement le modèle Opus.
Des techniques dédiées pour extraire la chaîne de pensée
Anthropic n’expose pas habituellement la chaîne de pensée interne de ses modèles et affiche plutôt des pensées résumées. La société rapporte toutefois que des campagnes ont utilisé des techniques spécifiques pour pousser le modèle à livrer ses traces de raisonnement. Dans un exemple, l’attaquant a reformulé la sollicitation comme une tâche de traduction en japonais en katakana afin de tromper le système. De manière générale, ces opérations visent à extraire la chaîne de pensée d’une réponse pour l’exploiter ensuite dans l’entraînement supervisé d’un modèle plus petit au raisonnement général.
Cinq campagnes au total et une intensification récente
Au total, Anthropic déclare avoir observé près de 200 millions d’échanges attribués à cinq campagnes distinctes. L’entreprise a publié un nouveau rapport alléguant des attaques de distillation persistantes menées par des acteurs basés en Chine et une intensification au cours des derniers mois, avec des laboratoires non autorisés développant des méthodes plus sophistiquées pour contourner ses défenses et exploiter des modèles de pointe. Selon Anthropic, les campagnes ont visé plusieurs capacités de Claude comme les fonctions agentiques et l’utilisation d’outils, la programmation, l’analyse de données et le raisonnement logique. Anthropic avait déjà évoqué ces attaques en février, et OpenAI a de son côté attribué une activité similaire à DeepSeek. Le nouveau document les présente comme plus vastes et plus agressives que celles décrites auparavant.
Brief IA — L'actualité IA en français
L'essentiel de l'actualité de l'intelligence artificielle, décrypté et expliqué chaque jour.