Brief IA : Anthropic forcé de désactiver ses IA Claude Fable 5 et Mythos

Anthropic forcé de désactiver ses IA Claude Fable 5 et Mythos

Brief IA
Tom Levy·4 min·14 vues

Le gouvernement a décidé de retirer un modèle commercial d'Anthropic, utilisé par des millions d'utilisateurs, en raison de la découverte d'une vulnérabilité potentielle. Cette décision soulève des questions sur la sécurité et la régulation des IA déployées à grande échelle, ce qui pourrait influencer la confiance du public et la régulation future des technologies d'IA.

En bref
1Washington a suspendu l'accès à Claude Fable 5 et Mythos 5, invoquant des préoccupations de sécurité nationale.
2Mythos, capable de détecter des vulnérabilités logicielles, était limité à 50 organisations pour la cybersécurité.
3Fable 5, lancé récemment, était conçu pour être sûr pour le grand public, mais un potentiel jailbreak a été évoqué.
💡Pourquoi c'est importantCette suspension pourrait perturber les plans d'Anthropic pour son introduction en bourse, affectant sa position sur le marché de l'IA.
Le brief IA que lisent les pros

Tu suis la course aux modèles IA ?

Chaque sortie (GPT, Claude, Gemini, Mistral…) décryptée le soir même, en 5 min. Gratuit.

Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.

Choisis ton rythme

Gratuit · Pas de spam · Désabonnement en 1 clic

📄
L'analyse en français

Le gouvernement américain a récemment pris une décision drastique en ordonnant à Anthropic de désactiver immédiatement l'accès à deux de ses modèles d'intelligence artificielle les plus avancés : Claude Fable 5 et Claude Mythos 5. Cette directive, émise vendredi, repose sur des préoccupations de sécurité nationale. Anthropic a confirmé sa conformité à cette directive via une annonce sur X, tout en exprimant clairement son désaccord avec l'évaluation du gouvernement.

La directive, reçue précisément à 17h21 (heure de l'Est), impose à Anthropic de désactiver ces modèles pour tous les utilisateurs à travers le monde, et non seulement pour les ressortissants étrangers comme le prévoit généralement l'ordre de contrôle des exportations. Les autres modèles d'Anthropic ne sont pas concernés par cette suspension.

Mythos est reconnu comme le modèle d'IA le plus performant d'Anthropic, introduit au début du mois d'avril. Il a été maintenu sous des restrictions strictes en raison de sa capacité exceptionnelle à détecter des vulnérabilités de sécurité dans les logiciels. Selon Anthropic, Mythos a identifié des défauts dans tous les principaux systèmes d'exploitation et navigateurs web qu'il a testés. Plutôt que de le rendre largement accessible, l'entreprise a choisi de le partager dans le cadre d'un programme contrôlé appelé Project Glasswing. Ce programme inclut environ 50 organisations vérifiées, parmi lesquelles figurent des géants de la technologie tels qu'Amazon, Apple, Google, Microsoft et CrowdStrike, pour des travaux de cybersécurité défensive.

Fable 5, quant à lui, a été lancé il y a seulement trois jours. Conçu comme une réponse à la pression commerciale, il s'agit d'une version de Mythos dotée de garde-fous qui bloquent les réponses dans des domaines à haut risque comme la cybersécurité et la biologie. Cela le rend suffisamment sûr pour une sortie générale, selon l'entreprise. D'après les tests de référence de Vals AI, une entreprise spécialisée dans le suivi des performances des technologies d'IA, Fable 5 s'est immédiatement imposé comme le modèle d'IA le plus performant disponible au public.

La décision du gouvernement est présentée comme une action de contrôle des exportations, visant à restreindre l'accès aux modèles pour les ressortissants étrangers. Cependant, dans un long article de blog, Anthropic affirme que sa compréhension est que la préoccupation sous-jacente concerne un prétendu jailbreak de Fable 5. Jusqu'à présent, l'entreprise déclare que le gouvernement n'a fourni que des preuves verbales d'un "jailbreak potentiel étroit et non universel". Selon Anthropic, cela consiste à inciter le modèle à lire une base de code spécifique et à identifier des défauts logiciels. De plus, l'entreprise ajoute qu'il s'agit d'un niveau de capacité déjà largement disponible dans d'autres modèles accessibles au public, y compris GPT-5.5 d'OpenAI. Cette capacité est également utilisée régulièrement par des professionnels de la cybersécurité à des fins défensives.

L'argument plus large d'Anthropic est que ses protections les plus solides fonctionnent à travers des systèmes de classification indépendants qui opèrent séparément du modèle lui-même. Cela signifie que même si quelqu'un parvient à convaincre Fable de continuer à parler après un refus, les protections sous-jacentes contre les sorties les plus dangereuses restent en place.

Manifestement, rien de tout cela n'a suffi à empêcher le gouvernement d'agir, et Anthropic ne cache pas sa frustration. "Nous ne sommes pas d'accord pour dire que la découverte d'un jailbreak potentiel étroit devrait justifier le rappel d'un modèle commercial déployé auprès de centaines de millions de personnes", a écrit l'entreprise. "Si cette norme était appliquée dans toute l'industrie, nous croyons qu'elle arrêterait essentiellement tous les nouveaux déploiements de modèles pour tous les fournisseurs de modèles de pointe."

Anthropic devrait poursuivre une introduction en bourse (IPO) cette année et a beaucoup misé sur son identité publique en tant qu'alternative soucieuse de la sécurité face à ses concurrents. L'ironie n'échappe pas aux observateurs que la prudence même qu'Anthropic a affichée en restreignant Mythos — qu'elle a promu comme un modèle si dangereux qu'il ne pouvait pas être publié publiquement — a maintenant apparemment attiré exactement le type de surveillance gouvernementale qui pourrait perturber son activité.

Sam Altman d'OpenAI doit apprécier cela, au moins. En avril, il a déclaré au podcasteur Ashlee Vance que la gestion de Mythos par Anthropic équivalait à du "marketing basé sur la peur". "C'est clairement un marketing incroyable de dire : 'Nous avons construit une bombe. Nous étions sur le point de la faire tomber sur votre tête. Nous allons vous vendre un abri anti-bombe pour 100 millions de dollars'", a déclaré Altman. Altman, dont l'entreprise est également largement attendue pour poursuivre une IPO dès que possible, n'a pas prédit une fermeture gouvernementale, mais il a identifié quelque chose qui est revenu hanter Anthropic pour l'instant, à savoir que lorsque vous passez des mois à dire au monde que votre IA est exceptionnellement dangereuse, le monde — y compris le gouvernement américain — a tendance à écouter.

Suivez Brief IA

L'actu IA du jour, aussi dans votre fil.

Commentaires