Brief IA : Anthropic relance Fable 5 après une interdiction américaine

Anthropic relance Fable 5 après une interdiction américaine

Brief IA
Tom Levy·4 min·7 vues

Après une interdiction de deux semaines par le gouvernement américain due à un jailbreak découvert par Amazon, Anthropic a pu à nouveau distribuer Fable 5 mondialement. L'entreprise a mis en place un nouveau classificateur de sécurité qui bloque cette exploitation dans plus de 99 % des cas, bien qu'il augmente également les faux positifs. Cette situation souligne les défis de sécurité persistants pour les modèles d'IA avancés et l'impact des régulations gouvernementales sur leur déploiement.

En bref
1Anthropic peut à nouveau distribuer Fable 5 mondialement après une interdiction de deux semaines par le gouvernement américain.
2Un jailbreak découvert par Amazon avait conduit à cette interdiction, mais Anthropic souligne que même Claude Haiku 4.5 pourrait être exploité de la même manière.
3Un nouveau classificateur de sécurité bloque cette exploitation dans plus de 99 % des cas, mais augmente aussi les faux positifs.
💡Pourquoi c'est importantLa réintroduction de Fable 5 montre les défis de sécurité persistants pour les modèles d'IA avancés et l'impact des régulations gouvernementales sur leur déploiement.
Le brief IA que lisent les pros

Tu suis la course aux modèles IA ?

Chaque sortie (GPT, Claude, Gemini, Mistral…) décryptée le soir même, en 5 min. Gratuit.

Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.

Choisis ton rythme

Gratuit · Pas de spam · Désabonnement en 1 clic

📄
L'analyse en français

Anthropic relance Fable 5 après une interdiction américaine

Après une suspension de deux semaines, le gouvernement américain a levé les contrôles à l'exportation sur le deuxième modèle d'IA le plus puissant d'Anthropic, Fable 5, le rendant à nouveau disponible dans le monde entier.

La version moins restreinte, Mythos 5, reste limitée à un groupe sélectionné d'organisations américaines.

Anthropic a formé un nouveau filtre qui bloque certaines demandes en tant que solution, mais ce filtre rejette également plus souvent des tâches de programmation inoffensives.

Fable 5 est de retour dans le monde entier à partir d'aujourd'hui via la Claude Platform, Claude.ai, Claude Code, et Claude Cowork. Les plans Pro, Max, Team et certains plans Entreprise incluent le modèle jusqu'au 7 juillet avec des limites d'utilisation hebdomadaires allant jusqu'à 50 %. Après cela, il sera facturé via des crédits d'utilisation. L'accès sur AWS, Google Cloud, et Microsoft Foundry sera rétabli "aussi rapidement que possible".

Mythos 5, la version moins restreinte du même modèle de base, reste limitée à un groupe d'organisations américaines qui ont obtenu l'approbation gouvernementale le 26 juin. Anthropic indique qu'elle travaille toujours avec le gouvernement pour élargir l'accès à d'autres partenaires dans le programme dit Glasswing. Il reste incertain si l'UE rejoindra ce programme.

Anthropic confirme que l'interdiction provient d'une découverte de sécurité par des chercheurs d'Amazon. Ils avaient trouvé un moyen de contourner les garde-fous de sécurité de Fable 5. Le modèle a ensuite identifié plusieurs vulnérabilités logicielles et, dans un cas, a produit un code montrant comment en exploiter une.

Anthropic affirme qu'il est "probablement impossible" de créer un modèle d'IA qui ne puisse pas être jailbreaké.

Le gouvernement américain et Anthropic ont passé deux semaines à enquêter sur la vulnérabilité. De nombreux modèles moins performants auraient pu repérer les mêmes défauts que ceux trouvés par Fable 5 dans le rapport, y compris Claude Opus 4.8, GPT-5.5, et Kimi K2.7. Pour la démonstration d'exploit spécifique, chaque modèle testé a produit le même résultat, même des modèles beaucoup plus petits comme Claude Haiku 4.5.

Anthropic qualifie cela de cas particulier qui n'impliquait que des travaux de cybersécurité défensive de routine. En réponse, la société a formé un classificateur de sécurité amélioré qui bloque la technique du rapport d'Amazon dans plus de 99 % des cas. Lorsqu'une demande est bloquée, les utilisateurs reçoivent une notification, et la demande est redirigée vers l'ancien modèle Opus 4.8.

Cependant, le nouveau classificateur a un inconvénient. Il signale plus souvent des demandes inoffensives lors de la programmation et du débogage quotidiens. Les utilisateurs s'étaient déjà plaints que le modèle était trop restrictif lors de la première version de Fable.

Le diagramme d'Anthropic montre que la marge de sécurité pour Fable 5 (ligne B) est beaucoup plus large que pour les garde-fous standard (ligne A). Plus de demandes inoffensives sont bloquées, mais moins de demandes dangereuses passent à travers.

Aucun jailbreak universel n'a été trouvé au moment de la sortie. Mais la société admet qu'il est "probablement impossible de rendre un modèle d'IA totalement robuste (c'est-à-dire imperméable) aux jailbreaks". Cela était bien connu avant le lancement de Fable 5.

L'industrie de l'IA a besoin d'une norme partagée pour évaluer les jailbreaks et déclencher des contre-mesures, soutient Anthropic. La société déclare qu'elle construit un tel cadre avec Amazon, Microsoft, Google, et d'autres partenaires de Glasswing. Anthropic met également en place une équipe pour une surveillance 24/7 des canaux de soumission de jailbreak et a lancé un nouveau programme HackerOne où les chercheurs en sécurité peuvent signaler des jailbreaks cybernétiques potentiels pour Fable 5.

Anthropic souhaite un contrôle gouvernemental plus étroit sur les modèles de pointe

Anthropic élargit son travail avec le gouvernement américain, s'appuyant sur leurs efforts conjoints liés à l'ordre exécutif.

La société fait plusieurs engagements. Les partenaires gouvernementaux auront un accès préliminaire aux modèles qui avancent les capacités dans des domaines sensibles à la sécurité. Les jailbreaks ou les modèles d'abus découverts seront partagés rapidement. Anthropic mettra à disposition des ressources dédiées et une puissance de calcul significative pour la recherche conjointe. Et la société aidera à établir une norme industrielle partagée pour les fournisseurs de modèles de pointe.

Anthropic souhaite que tout cela soit inscrit dans une "réglementation stricte" et appliqué de manière égale à tous les développeurs de modèles de pointe. "L'implication du gouvernement dans les sorties d'IA nécessite un processus durable et transparent qui donne aux défenseurs cybernétiques et à d'autres la certitude dont ils ont besoin concernant l'accès à des modèles puissants", écrit la société.

Suivez Brief IA

L'actu IA du jour, aussi dans votre fil.

Commentaires