Brief IA : Anthropic relance Fable 5 après la levée des restrictions américaines

Anthropic relance Fable 5 après la levée des restrictions américaines

Brief IA
Tom Levy·5 min·8 vues

Anthropic relance Claude Fable 5 après que le Department of Commerce a levé les contrôles à l'exportation sur ce modèle et Mythos 5. Cette décision permet à l'entreprise de reprendre ses activités mondiales sur des plateformes comme AWS, Google Cloud et Microsoft Foundry, renforçant ainsi sa position sur le marché des IA.

En bref
1Anthropic va réactiver Claude Fable 5 après des négociations avec l'administration Trump.
2Le Department of Commerce a levé les contrôles à l'exportation sur Fable 5 et Mythos 5.
3La réactivation sur AWS, Google Cloud et Microsoft Foundry est prévue, sans date précise.
💡Pourquoi c'est importantLa levée des restrictions permet à Anthropic de reprendre ses activités mondiales, renforçant sa position sur le marché des IA.
Le brief IA que lisent les pros

Tu suis la course aux modèles IA ?

Chaque sortie (GPT, Claude, Gemini, Mistral…) décryptée le soir même, en 5 min. Gratuit.

Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.

Choisis ton rythme

Gratuit · Pas de spam · Désabonnement en 1 clic

📄
L'analyse en français

Anthropic relance Fable 5 après la levée des restrictions américaines

Après plusieurs semaines de négociations avec l'administration Trump, Anthropic est enfin en mesure de remettre Claude Fable 5 en ligne. Dans un post sur X, Anthropic a annoncé qu'il prévoyait de commencer à restaurer l'accès mercredi pour les utilisateurs du monde entier sur les plateformes Claude, et que l'entreprise réactiverait bientôt l'accès sur AWS, Google Cloud et Microsoft Foundry, sans toutefois fournir de calendrier précis.

Anthropic a déclaré :

"Nous avons reçu notification que le Département du Commerce a levé les contrôles à l'exportation sur Claude Fable 5 et Mythos 5. Nous commencerons à restaurer l'accès demain et partagerons bientôt une mise à jour. Nous sommes reconnaissants envers nos utilisateurs pour leur patience, et à tous ceux qui ont travaillé avec nous pour redéployer les modèles."

L'entreprise a également publié un article de blog mardi soir détaillant les événements ayant conduit à cette situation, ses nouvelles mesures de sécurité, les nouveaux processus de l'industrie de l'IA sur lesquels elle travaille, ainsi que de nouvelles manières de partager des informations avec le gouvernement, et des tests préalables pour les modèles à venir.

Début juin, Anthropic avait mis de côté Fable 5 — son modèle destiné aux consommateurs, construit à partir de la même technologie sous-jacente que Mythos 5, mais avec davantage de protections — après un ultimatum de l'administration Trump. En raison de préoccupations concernant des éventuelles jailbreaks de la technologie, le gouvernement avait imposé à Anthropic une directive de contrôle à l'exportation, interdisant à tout ressortissant étranger (y compris les membres non américains des entreprises clientes et même de nombreux employés d'Anthropic) d'utiliser Mythos 5 ou Fable 5, c'est-à-dire les deux modèles qu'Anthropic avait mis en avant la semaine précédente.

Pour répondre à la problématique des jailbreaks, que des chercheurs d'Amazon avaient signalée et qui avait largement contribué à la mise en œuvre de la directive de contrôle à l'exportation, Anthropic a indiqué dans son article de blog qu'elle avait "formé un classificateur de sécurité amélioré qui cible et bloque" ce comportement, ajoutant : "Les utilisateurs seront informés si une demande à Fable 5 est bloquée, et la demande sera alors redirigée vers Opus 4.8. Le nouveau classificateur signifie que la technique spécifique décrite dans le rapport d'Amazon est bloquée dans plus de 99% des cas."

L'administration Trump a récemment donné son feu vert au retour de Mythos 5, mais uniquement pour une liste d'organisations préapprouvées. Les membres non américains de ces organisations, ainsi que les employés étrangers d'Anthropic, ont pu retrouver l'accès au modèle. Cette décision est intervenue peu après qu'OpenAI a dévoilé GPT-5.6, que l'administration Trump n'a autorisé à être lancé que sous des règles similaires : un déploiement échelonné, initialement réservé à une liste d'organisations et de départements gouvernementaux préapprouvés.

Mardi, Anthropic a indiqué qu'elle "continuera de coordonner avec le gouvernement pour élargir l'accès à un plus large ensemble de partenaires nationaux et internationaux" pour Mythos 5. L'entreprise a également inclus une section entière dans son article de blog sur son nouveau plan de collaboration étroite avec l'administration Trump, mettant en avant ses nombreuses tentatives pour regagner la confiance du gouvernement après des mois de drame public, de poursuites judiciaires et d'actions présidentielles.

Anthropic a déclaré qu'elle prévoyait d'offrir un "accès et une évaluation gouvernementaux en pré-lancement", en particulier pour les modèles pertinents pour les capacités de sécurité nationale, afin que les partenaires gouvernementaux puissent réaliser des évaluations indépendantes des capacités des modèles et tester les garde-fous avant un déploiement plus large. (Le gouvernement aura également accès au personnel technique d'Anthropic pendant ces périodes de tests préalables.)

Anthropic a également prévu d'introduire un "partage rapide d'informations" lorsque des "jailbreaks significatifs ou des motifs d'utilisation abusive sont identifiés."

Elle a annoncé qu'elle travaillerait avec le gouvernement et d'autres laboratoires d'IA de premier plan pour créer une "norme de sécurité et d'évaluation partagée, volontaire" pour les fournisseurs de modèles avancés. Enfin, Anthropic a déclaré qu'elle mettrait en place des équipes dédiées pour travailler sur les priorités gouvernementales partagées, fournirait une allocation de calcul significative pour soutenir les tests et la recherche gouvernementaux, et mettrait son expertise en matière de sécurité et de tests de résistance à disposition pour faire progresser l'état de l'art dans l'évaluation de l'IA.

La directive initiale de contrôle à l'exportation de l'administration Trump est survenue à un moment inopportun pour Anthropic, alors que l'entreprise se préparait à une introduction en bourse et avait eu des différends avec le gouvernement pendant des mois concernant une désignation de risque pour la chaîne d'approvisionnement.

L'entreprise a souligné dans son article de blog qu'il n'existe "actuellement aucun consensus dans l'industrie de l'IA" pour décider de la gravité d'un jailbreak, un problème qui "deviendra plus aigu dans les mois à venir, alors que davantage de modèles dotés de puissantes capacités de cybersécurité (et d'autres) sont formés, évalués et publiés." Elle a donc collaboré avec Amazon, Microsoft, Google et d'autres entreprises participant à son programme Project Glasswing afin d'élaborer un cadre largement accepté pour évaluer les jailbreaks de l'IA, avec quatre catégories proposées :

  • gain de capacité pour l'attaquant
  • étendue du gain de capacité pour l'attaquant
  • facilité de l'armement de manière plus générale
  • découvrabilité (ou la facilité avec laquelle quelqu'un d'autre peut le reproduire)

Anthropic a également créé une nouvelle équipe pour "fournir une surveillance 24/7 des principaux canaux de soumission de jailbreaks" et lancera bientôt un programme HackerOne pour que les chercheurs soumettent les jailbreaks potentiels qu'ils ont signalés pour Fable 5.

Anthropic a également inclus un avertissement dans son article de blog, écrivant qu'il est "probablement impossible de rendre un modèle d'IA totalement robuste (c'est-à-dire imperméable) aux jailbreaks. Nous nous attendons à ce que certains jailbreaks soient découverts pour nos modèles, et qu'ils varient en gravité : il y aura de nombreux jailbreaks mineurs, certains nuisibles de manière étroite, et bien qu'aucun jailbreak universel pour Fable 5 n'ait été découvert au moment de la rédaction, des chercheurs en sécurité experts continuent de le tester."

Suivez Brief IA

L'actu IA du jour, aussi dans votre fil.

Commentaires