Tu veux les meilleurs outils IA avant les autres ?
On teste et on décrypte les nouveaux outils IA chaque soir, en 5 min. Gratuit.
Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.
Choisis ton rythme
Gratuit · Pas de spam · Désabonnement en 1 clic
Anthropic en tête du classement général
En juin 2026, Anthropic s'impose comme le leader incontesté du marché de l'IA générative. Son modèle Claude Fable 5, issu de la nouvelle famille Mythos, occupe la première place du classement établi par Arena, anciennement connu sous le nom de LMArena. Ce modèle, bien qu'il soit en tête, a été désactivé pour les utilisateurs non américains suite à une directive du gouvernement des États-Unis, limitant son accès aux seuls ressortissants américains.
Les cinq premières positions du classement sont toutes occupées par des modèles d'Anthropic, avec notamment les versions "thinking" de Claude Opus 4.6 et Claude Opus 4.7. Ce classement, qui repose sur les votes des utilisateurs, témoigne de la suprématie d'Anthropic dans le domaine de l'IA générative.
Classement par catégories
Développement web
Dans la catégorie du développement web, Anthropic domine largement avec huit modèles parmi les dix premiers. Claude Fable 5 et les versions "thinking" de Claude Opus 4.7 et Claude Opus 4.8 forment le trio de tête. Qwen 3.7 "max" et GLM-5.1 parviennent à se classer en huitième et neuvième positions respectivement, montrant une légère diversité dans un classement largement dominé par Anthropic.
Analyse d'image
Anthropic continue sa domination dans l'analyse d'image, avec Claude Opus 4.7 "thinking" en première place. Muse Spark et Gemini 3 Pro se classent respectivement sixième et septième, soulignant la capacité d'Anthropic à maintenir une position forte dans plusieurs catégories.
Analyse de documents
Pour l'analyse de documents, Claude Opus 4.6 standard est le modèle le plus performant selon les utilisateurs d'Arena, suivi par ses déclinaisons "thinking". OpenAI parvient à placer trois de ses modèles dans le top 10, avec GPT-5.5 "high" en septième position, GPT-5.5 en huitième, et GPT-5.4 en neuvième, illustrant une concurrence notable dans cette catégorie.
Génération d'images
En génération d'images, OpenAI se distingue avec GPT Image 2, qui devance Reve 2.0 et Gemini 3.1 Flash. MAI-Image 2.5 de Microsoft et Gemini 3 Pro complètent le top 5, démontrant la capacité d'OpenAI à exceller dans la création visuelle.
Recherche web
Dans la recherche web, Claude Opus 4.6 "search" d'Anthropic reste en tête, suivi par GPT-5.5 "search" et Claude Opus 4.7. Ernie 5.1 de Baidu se classe quatrième, montrant une compétition internationale dans cette catégorie spécifique.
Méthodologie de classement d'Arena
Arena évalue les modèles d'IA en organisant des duels anonymisés où chaque modèle répond à un même prompt. Les utilisateurs votent pour le modèle le plus performant, et un score Elo est attribué, évoluant selon les résultats des duels. Un modèle gagne des points en battant un concurrent mieux classé et en perd face à un adversaire moins bien classé. Cette méthode, inspirée des échecs, permet une évaluation continue et objective des performances des modèles.


