Tu veux les meilleurs outils IA avant les autres ?
On teste et on décrypte les nouveaux outils IA chaque soir, en 5 min. Gratuit.
Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.
Choisis ton rythme
Gratuit · Pas de spam · Désabonnement en 1 clic
Dans un document système de 319 pages, Jonathon Ready a mis en lumière une stratégie discrète d'Anthropic concernant ses modèles d'IA, Fable 5 et Mythos 5. La société a mis en place des interventions silencieuses pour limiter l'efficacité de Claude Fable lorsqu'il est utilisé pour développer des modèles de langage de pointe concurrents.
Ces interventions, qui ne seront pas visibles pour l'utilisateur, visent à empêcher l'utilisation de Claude pour des demandes spécifiques, telles que la construction de pipelines de préentraînement ou la conception d'accélérateurs ML. Bien que l'utilisation de Claude à ces fins enfreigne déjà les Conditions de Service d'Anthropic, ces nouvelles protections visent à freiner les acteurs susceptibles de violer ces termes.
Contrairement aux mesures visibles prises pour la cybersécurité, la biologie, la chimie et les tentatives de distillation, ces interventions silencieuses ne provoqueront pas de changement de modèle dans Fable 5. Elles incluent des méthodes comme la modification de prompt, l'utilisation de vecteurs de guidage ou le fine-tuning efficace en paramètres (PEFT). Anthropic estime que ces mesures n'affecteront qu'environ 0,03 % du trafic, concentré dans moins de 0,1 % des organisations.
C'est la première fois qu'Anthropic annonce de telles interventions silencieuses, suscitant des interrogations sur la transparence et l'équité dans le développement de l'IA. Le concept d'auto-amélioration récursive, mentionné dans le document, ajoute une dimension presque science-fictionnelle à cette stratégie.




