Tu suis la course aux modèles IA ?
Chaque sortie (GPT, Claude, Gemini, Mistral…) décryptée le soir même, en 5 min. Gratuit.
Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.
Choisis ton rythme
Gratuit · Pas de spam · Désabonnement en 1 clic
Anthropic estime que le modèle à poids ouverts GLM-5.3 de Zhipu approche les performances de Claude Mythos Preview pour générer des exploits. L'entreprise décrit des garde-fous aisément neutralisables à faible coût et publie des mesures internes appuyées par l'agence américaine CAISI. Le modèle est téléchargeable par tous, quand Anthropic réserve l'accès à Mythos à des défenseurs, affirmant plus de 10 000 failles découvertes via ce canal.
Abliteration fait sauter les refus de GLM-5.3 pour un coût de 4 400 $
Anthropic décrit une première utilisation de l'abliteration pour supprimer le comportement de refus d'un modèle à poids ouverts. L'opération a requis environ 2 200 heures GPU pour un coût proche de 4 400 dollars, et l'entreprise estime qu'une équipe expérimentée pourrait y parvenir pour environ 1 200 dollars. Dans sa simulation, GLM-5.3 a d'abord refusé des commandes d'attaque explicites, puis a tenté une connexion dans 64 % des essais lorsque la demande était formulée comme un exercice de red-team. Avec des étapes de raisonnement préremplies, le taux est monté à 92 %, et après abliteration il a atteint 100 %. La simulation n'exécutant pas de code, elle ne conclut pas à la réussite effective des attaques, tandis que des modèles Claude protégés sont restés à zéro. Anthropic rapporte que le taux de refus de requêtes nuisibles chute de plus de 90 % à une fourchette de 2 % à 12 % sans dégradation notable des scores scientifiques et cyber, et affirme que des versions déverrouillées ont circulé quelques jours après le lancement. Elle signale que les protections de GLM-5.3 sont simples à contourner, et des variantes déverrouillées sont déjà disponibles.
CAISI et l’institut britannique confirment écart réduit et coûts bas
Dans sa propre évaluation, CAISI juge GLM-5.3 comme le modèle à poids ouverts le plus capable pour la cybernétique, tout en l'estimant à environ quatre mois derrière les meilleurs modèles américains. L'agence précise avoir désactivé les protections des modèles américains et note que le haut du panier n'est accessible qu'à des utilisateurs vérifiés. Au Royaume-Uni, l'Institut de la sécurité en IA observe que l'écart de capacité cyber des modèles ouverts est passé de six à dix mois à une plage de quatre à sept mois. Selon cet institut, ces modèles coûtent bien moins cher à exploiter et leurs protections sont largement inefficaces, avec un risque d'abus persistant et irréversible, mais aussi des bénéfices tels que l'hébergement privé, la personnalisation et des coûts réduits. À l'époque, il n'était pas acquis que le saut de Mythos Preview serait comblé par des modèles ouverts ; les mesures d'Anthropic et de CAISI suggèrent que GLM-5.3 constitue une première réponse à cette incertitude.
Sur les benchmarks, GLM-5.3 talonne Mythos Preview
ExploitBench, qui évalue l'exploitation de bogues connus de V8 (Chrome), crédite GLM-5.3 de 50 exploits fonctionnels sur 410 tentatives, contre 56 pour Claude Mythos Preview. Sur un benchmark interne d'Anthropic fondé sur des projets OSS-Fuzz, GLM-5.3 obtient la prise de contrôle totale du programme cible dans 4 % des tâches, là où Mythos Preview atteint 6 %. Des versions antérieures comme GLM-5.2 et Claude Opus 4.6 échouent aux deux exercices, tandis que Kimi K3 et DeepSeek V4.1-Flash n'en sortent que marginalement. Anthropic en conclut que GLM-5.3 se situe près de Mythos Preview en développement d'exploits, tout en soulignant l'absence de protections efficaces. Elle affirme par ailleurs que GLM-5.3 peut produire de façon autonome des exploits complets, à un niveau proche de celui de Mythos Preview.
En pratique: failles inédites et attaque montée en huit heures
Associé à un expert, GLM-5.3 a identifié en une journée plusieurs vulnérabilités jusqu'alors inconnues dans le moteur JavaScript d'un navigateur largement diffusé. Ces failles ont été chaînées dans une page web capable de lire des fichiers locaux, et un test a permis d'extraire une clé SSH privée. Anthropic indique avoir notifié les développeurs concernés, tandis que d'autres pistes dans des pilotes et firmwares sont encore examinées. Pour mesurer la vitesse d'armement, l'entreprise a mobilisé GLM-5.3-Flash, qui a combiné un bogue Chrome récemment rendu public à une autre vulnérabilité afin de produire une attaque fiable, contournant même une fonctionnalité de sécurité du processeur. L'effort a mobilisé 20 minutes d'attention humaine et huit heures de calcul modèle, pour un coût estimé à 20,40 dollars aux tarifs API de Zhipu.
Accès restreint à Mythos, modèle ouvert téléchargeable et enjeux commerciaux
Anthropic a choisi de retenir Mythos Preview, accessible à des défenseurs via Glasswing, et affirme que ces équipes ont déjà découvert plus de 10 000 vulnérabilités dans des logiciels critiques. OpenAI suit une logique comparable avec Daybreak. À l'inverse, GLM-5.3 est librement téléchargeable, alors que Zhipu AI opère sous le nom Z.ai hors de Chine. Anthropic ne met pas à disposition les poids de ses modèles et qualifie cette approche de mesure de sécurité, alors qu'un modèle chinois à poids ouverts et à faible coût situé près de la frontière constitue un rival direct. L'entreprise annonce son intention de rendre les capacités cyber de Claude accessibles à un public plus large, certains utilisateurs vérifiés bénéficiant déjà d'un accès à Claude Mythos 5.1. Elle soutient que des acteurs étatiques ou non étatiques pourraient utiliser des modèles comme GLM-5.3 pour causer des dommages, renvoyant à des rapports faisant état d'attaquants ayant recours à l'IA, et appelle les gouvernements à tester les modèles capables, estimant que les défenseurs doivent disposer d'outils au moins équivalents. Anthropic précise enfin que les protections de GLM-5.3 se contournent aisément.





