Tu veux les meilleurs outils IA avant les autres ?
On teste et on décrypte les nouveaux outils IA chaque soir, en 5 min. Gratuit.
Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.
Choisis ton rythme
Gratuit · Pas de spam · Désabonnement en 1 clic
Anthropic en tête du classement général
Depuis plusieurs mois, Anthropic s'affirme comme un acteur majeur dans le domaine de l'intelligence artificielle, grignotant progressivement des parts de marché à OpenAI. En juillet 2026, cette tendance se confirme avec Anthropic qui continue de dominer le classement général, bien que quelques surprises soient à noter dans des segments spécifiques comme le développement web.
En juin, Anthropic avait déjà réussi à s'emparer des cinq premières places du classement général. Cette situation perdure en juillet, avec Claude Fable 5 qui conserve la première position, suivi de près par les versions "thinking" de Claude Opus 4.6 et 4.7. Les versions standard de ces modèles complètent le top 5. Le parcours de Claude Fable 5 a été mouvementé depuis son lancement le 9 juin, étant le premier modèle public de la classe Mythos. Il a été brièvement suspendu par le département du Commerce américain le 12 juin pour tout utilisateur étranger, avant d'être rétabli le 1er juillet après la levée des restrictions par Washington.
Dans le reste du classement, Meta continue sa progression discrète. Ses modèles Muse Spark se positionnent en sixième et septième place, surpassant Google, Moonshot, et OpenAI, qui se retrouvent en huitième, neuvième et dixième position respectivement.
Voici les 10 modèles de langage les plus performants en juillet 2026, toutes tâches confondues :
- Claude Fable 5
- Claude Opus 4.6 "thinking"
- Claude Opus 4.7 "thinking"
- Claude Opus 4.6
- Claude Opus 4.7
- Muse Spark 1.1
- Muse Spark
- Gemini 3 Pro
- kimi-k3
- GPT-5.6 Sol (xHigh)
Nouveaux classements par catégorie
Ce mois-ci, Arena a introduit une nouvelle catégorie dédiée à l'IA agentique, ajoutant une dimension supplémentaire aux classements thématiques traditionnels. Voici les principales tendances observées en juillet 2026 :
-
IA agentique : Anthropic et OpenAI se disputent les premières places de cette nouvelle catégorie, avec Anthropic légèrement en tête. Claude Fable 5 (High) devance GPT-5.6 Sol (xHigh) et Claude Opus 4.8 "thinking".
-
Développement web : Après une longue période de domination par Anthropic, Moonshot crée la surprise avec kimi-k3 qui s'empare de la première place, devant Claude Fable 5 et GPT-5.6 Sol.
-
Analyse d'image : Anthropic reprend le contrôle avec Claude Fable 5 en tête, suivi de plusieurs déclinaisons de Claude Opus. Muse Spark de Meta se classe sixième, devant Gemini 3 Pro.
-
Analyse de documents : Anthropic continue de dominer cette catégorie, avec Claude Opus 4.6 "thinking" en tête, suivi de près par Claude Fable 5 et Claude Opus 4.6. OpenAI réussit à se glisser dans le top 10.
-
Génération d'images : OpenAI conserve une avance notable avec GPT-Image-2 (medium), suivi de Reve 2.1 et Muse Image de Meta. Google place quatre variantes de Nano Banana dans le top 10.
-
Recherche web : Claude Opus 4.6 "search" reste en tête d'une catégorie très disputée, avec GPT-5.5 "search" en deuxième position. Ernie-5.1 de Baidu et deux variantes Gemini de Google montrent que plusieurs acteurs restent compétitifs derrière Anthropic.
Méthodologie de classement d’Arena
Arena s'appuie sur une méthode d'évaluation continue basée sur les retours de ses utilisateurs. La plateforme organise des duels anonymisés entre différents modèles, chacun étant soumis au même prompt. Les utilisateurs sont ensuite invités à choisir le modèle qui répond le mieux à la requête. Chaque modèle reçoit un score Elo, similaire à celui utilisé dans les échecs, qui évolue en fonction des résultats : un modèle gagne des points en battant un concurrent mieux classé et en perd face à un adversaire situé plus bas dans le classement.


