Brief IA : Anthropic bloque des abus de Claude pour l’ingénierie d’armes

Anthropic bloque des abus de Claude pour l’ingénierie d’armes

Brief IA
Tom Levy·4 min·4 vues

Anthropic a découvert que son modèle Claude avait été utilisé par des acteurs russes, chinois, au Yémen et liés à l'Iran pour des projets militaires, incluant des systèmes de nuées de drones et de ciblage naval. L'entreprise a fermé des comptes, partagé des informations avec les autorités et renforcé ses mesures de sécurité pour prévenir de futurs abus. Ces incidents soulignent les risques d'utilisation des modèles d'IA avancés dans des contextes militaires.

En bref
1Des acteurs russes, chinois, au Yémen et liés à l’Iran ont utilisé Claude pour des projets militaires
2Anthropic a identifié des usages allant de la nuée de drones à la collecte de données de ciblage naval
3L’entreprise a mené des enquêtes internes, fermé des comptes et renforcé ses mesures de sécurité
💡Pourquoi c'est importantCes cas illustrent les risques d’abus des modèles d’IA avancés dans des contextes militaires et la nécessité de dispositifs de détection et de gouvernance adaptés.
Le brief IA que lisent les pros

Tu suis la course aux modèles IA ?

Chaque sortie (GPT, Claude, Gemini, Mistral…) décryptée le soir même, en 5 min. Gratuit.

Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.

Choisis ton rythme

Gratuit · Pas de spam · Désabonnement en 1 clic

📄
L'analyse en français

Anthropic décrit plusieurs cas où son modèle Claude a servi d’appui à des travaux militaires : nuées de drones, système anti‑torpilles, logiciels de missiles et collecte de ciblage naval. L’entreprise affirme avoir découvert ces activités lors d’enquêtes internes, fermé des comptes et renforcé ses garde‑fous. Les exemples couvrent des acteurs en Russie, en Chine, au Yémen et liés à l’Iran.

Comptes fermés, partage avec les autorités et tests ratés au Yémen

Anthropic indique avoir interdit un compte lié à un acteur menaçant associé à l’Iran, transmis des informations aux autorités gouvernementales et développé des détections pour prévenir de futurs abus. Au nord du Yémen, l’entreprise rapporte qu’un test de missile guidé mené par des acteurs ayant utilisé Claude semble avoir échoué, ceux-ci revenant quelques heures après vers l’outil pour comprendre la cause. Selon la société, ces sessions portaient sur des logiciels de guidage, de navigation et de contrôle, Claude servant aussi à exécuter des simulations et à diagnostiquer des pannes.

Nuées de drones : un groupe russe a cherché l’autonomie létale

Un petit groupe d’acteurs russes, lié à une université régionale et présenté comme une opération freelance, a utilisé Claude pour bâtir le système logiciel central d’une nuée de drones. Les composants couvraient mémoire partagée, coordination tolérante aux pannes, comportements d’attaque, d’observation et de retour à la base, ainsi qu’un guidage terminal. Anthropic affirme que le logiciel pouvait sélectionner des cibles et ordonner des attaques sans intervention humaine et qu’il a été testé sur du matériel réel. L’entreprise ajoute que la plateforme a été conçue pour un engagement létal autonome, avec un modèle embarqué pouvant sélectionner des cibles et déclencher des détonations sans humain.

Imagerie du front ukrainien et neuf comptes sous enquête

Les mêmes groupes russes sont présentés comme des fournisseurs spécialisés. Ils ont conçu un outil reposant sur l’entraînement à partir d’images de combats en Ukraine pour différencier forces alliées et ennemies, utilisant en particulier une coordonnée géographique fixe située dans la région de Donetsk comme site de frappe pour la démonstration. Anthropic rapporte avoir repéré et examiné neuf comptes associés à ces activités, en soulignant que des VPN commerciaux ont été employés pour contourner les restrictions géographiques. Les comptes auraient été créés entre fin 2025 et début 2026 et leurs opérations ont commencé en mai.

Chine : anti‑torpilles, briefing sur l’US Navy et armes à énergie dirigée

Anthropic a repéré un acteur basé en Chine qui a mobilisé Claude pour élaborer une proposition destinée à la marine chinoise autour d’un système d’armement anti‑torpilles. L’outil a été utilisé pour rédiger en chinois des spécifications techniques et produire une proposition de plus de 200 pages accompagnée d’un dossier exécutif. Selon l’entreprise, l’acteur a comparé son design à des programmes américains à partir d’informations publiques et a affiné ses textes en demandant à Claude de jouer un critique hostile. Un briefing en chinois sur des systèmes de la marine américaine a aussi été généré à partir de sources ouvertes. Le compte a été interdit après découverte lors d’enquêtes internes. Anthropic mentionne par ailleurs un autre utilisateur en Chine s’appuyant sur Claude pour rassembler des informations sur des armes à énergie dirigée.

Ciblage naval lié à l’Iran fondé sur sources ouvertes

Un acteur lié à l’Iran a utilisé Claude pour compiler et analyser des informations publiques afin d’émettre des recommandations de ciblage contre des forces américaines. Le corpus rassemblé incluait un registre de personnel américain dérivé de légendes de photos militaires publiques, des identifiants de transpondeurs de navires et d’avions accessibles, des scripts de requêtes d’images satellites commerciales et un inventaire de sites exposant des mouvements navals américains.

Cadre plus large : périmètre des abus et gouvernance de l’IA

Les cas recensés s’inscrivent dans un périmètre plus large d’abus que l’entreprise rattache aussi à la cybersécurité et à la recherche sur les armes biologiques. Anthropic présente Claude comme un modèle américain de pointe dont des adversaires ont tenté de tirer parti. La société explique avoir mené des enquêtes internes pour identifier ces activités, fermé des comptes et renforcé ses mesures de sécurité. La publication intervient dans un contexte où l’administration Trump et la Silicon Valley avancent sur le développement de l’IA au milieu de préoccupations de sûreté. Quelques jours auparavant, le chercheur Jacob Coxon avait quitté Anthropic, dénonçant la course à développer des modèles et avertissant sur X que certaines personnes construisant l’IA estiment qu’elle pourrait tuer tout le monde d’ici la fin de la décennie.

Suivez Brief IA

L'actu IA du jour, aussi dans votre fil.

Commentaires