Tu suis la course aux modèles IA ?
Chaque sortie (GPT, Claude, Gemini, Mistral…) décryptée le soir même, en 5 min. Gratuit.
Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.
Choisis ton rythme
Gratuit · Pas de spam · Désabonnement en 1 clic
Le modèle Claude Fable 5 d'Anthropic a récemment démontré sa supériorité sur GPT-5.5 d'OpenAI en obtenant des scores remarquables sur le benchmark FrontierMath. Avec une avance de 13 points, Fable 5 s'impose sur les problèmes les plus difficiles de ce test réputé.
Selon Epoch AI, Claude Fable 5 atteint une précision de 87 % sur les niveaux 1 à 3 de FrontierMath et grimpe à 88 % sur le niveau 4, le plus complexe. Cette performance marque une avancée significative pour Anthropic, dont le modèle précédent, Opus 4.5, n'avait obtenu que moins de 10 % sur le même niveau en début d'année 2026.
En comparaison, le modèle GPT-5.5 d'OpenAI affiche environ 75 % de précision sur le niveau 4, bien que la version GPT-5.6 soit déjà en développement. Tous ces modèles ont été évalués selon l'échelle standard d'Epoch AI, qui exige un effort de raisonnement maximal.
FrontierMath est reconnu comme l'un des benchmarks les plus exigeants pour le raisonnement mathématique des intelligences artificielles. Les progrès réalisés par les modèles d'Anthropic et d'OpenAI ne se limitent pas aux benchmarks : récemment, un modèle d'OpenAI a résolu un problème d'Erdős de longue date, et Claude Mythos a également réussi cet exploit, illustrant les capacités croissantes de ces technologies.


