Tu veux les meilleurs outils IA avant les autres ?
On teste et on décrypte les nouveaux outils IA chaque soir, en 5 min. Gratuit.
Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.
Choisis ton rythme
Gratuit · Pas de spam · Désabonnement en 1 clic
Le palmarès collaboratif d’Arena de septembre 2026 consacre Anthropic au général, avec sept modèles dans le top 10. Selon les catégories, d’autres acteurs s’imposent : OpenAI prend la tête en développement web, ses nouvelles versions d’images dominent, et GPT‑5.6 Sol mène la recherche web en Elo.
Duels masqués et score Elo encadrent le palmarès d’Arena
Arena s’appuie sur des affrontements entre deux modèles à l’identité masquée, soumis au même prompt, que ses utilisateurs départagent. Chaque système reçoit un score Elo ajusté à chaque duel : battre un adversaire mieux classé rapporte, perdre face à un modèle supposé plus faible coûte. Dans la catégorie Recherche web, GPT‑5.6 Sol conserve une courte avance avec un Elo de 1 257 devant la version « search » de Claude Opus 4.6. Le top 10 de cette catégorie réunit aussi GPT‑5.5 Search, Claude Fable 5 et Gemini 3.1 Pro.
Au général, sept modèles Anthropic s’installent dans le top 10
En septembre 2026, Anthropic domine le classement général d’Arena et place sept modèles parmi les dix premiers. Meta et Google suivent derrière. OpenAI hisse deux modèles, GPT‑5.6 Sol « high » et GPT‑5.5 « high », dans le top 20. Le top 20 toutes tâches confondues réunit, dans l’ordre, Claude Fable 5 « high », Claude Opus 4.6 « high », Claude Opus 4.7 « high », Muse Spark 1.2 « xhigh », Claude Fable 5.1 « max », Claude Opus 4.6, Claude Opus 4.7, Muse Spark 1.3 « max », Gemini 3.8 Flash « high », Claude Opus 5 « high », Muse Spark 1.1, Gemini 3.7 Flash « high », Muse Spark, Claude Opus 5 « max », Gemini 3.1 Pro, Gemini 3 Pro, Kimi K3 « max », GPT‑5.6 Sol « high », GLM 5.3 « max » et GPT‑5.5 « high ».
Par tâches, OpenAI s’impose en web et en image, Anthropic en vision et documents
Arena publie des classements par catégories en plus du général. OpenAI prend la tête du WebDev avec GPT‑6 Astra, présenté par l’entreprise comme son meilleur modèle à ce jour pour le développement logiciel, devant Claude Fable 5.1 Max puis Claude Opus 5 Max. En Analyse d’image, Claude Fable 5 arrive premier, suivi de Qwen 3.8 et de Claude Opus 4.7 « high », tandis que Meta aligne trois modèles dans le top 10. En Analyse de documents, Anthropic occupe les sept premières places, menées par Claude Opus 5, et trois modèles d’OpenAI complètent le top 10. Côté Génération d’images, les nouvelles variantes « flare » et « sunburst » de ChatGPT Images 2.5, déployées il y a quelques jours, prennent les deux premières places du Text‑to‑image, leur prédécesseur rétrogradant troisième, et MAI Image 2.6 de Microsoft se classe quatrième.



