Brief IA

Anthropic place sept modèles dans le top 10 du classement Arena

🛠️ AI Tools·Tom Levy·

Anthropic place sept modèles dans le top 10 du classement Arena

Anthropic place sept modèles dans le top 10 du classement Arena
Key Takeaways
1Anthropic place sept modèles dans le top 10 du classement général Arena en septembre 2026
2OpenAI prend la première place en développement web avec GPT-6 Astra et domine la génération d’images avec ChatGPT Images 2.5
3Les classements par tâches révèlent aussi la domination d’Anthropic en analyse de documents et de Claude Fable 5 en vision
💡Why it mattersCe palmarès, fondé sur des duels à identité masquée et un score Elo, éclaire la répartition des forces entre acteurs majeurs de l’IA selon les usages.
Le brief IA que lisent les pros

Le brief IA que les pros lisent chaque soir

Les 7 actus IA du jour, décryptées en 5 min. Gratuit.

Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.

Choisis ton rythme

Gratuit · Pas de spam · Désabonnement en 1 clic

📄
Full Analysis

Le palmarès collaboratif d’Arena de septembre 2026 consacre Anthropic au général, avec sept modèles dans le top 10. Selon les catégories, d’autres acteurs s’imposent : OpenAI prend la tête en développement web, ses nouvelles versions d’images dominent, et GPT‑5.6 Sol mène la recherche web en Elo.

Duels masqués et score Elo encadrent le palmarès d’Arena

Arena s’appuie sur des affrontements entre deux modèles à l’identité masquée, soumis au même prompt, que ses utilisateurs départagent. Chaque système reçoit un score Elo ajusté à chaque duel : battre un adversaire mieux classé rapporte, perdre face à un modèle supposé plus faible coûte. Dans la catégorie Recherche web, GPT‑5.6 Sol conserve une courte avance avec un Elo de 1 257 devant la version « search » de Claude Opus 4.6. Le top 10 de cette catégorie réunit aussi GPT‑5.5 Search, Claude Fable 5 et Gemini 3.1 Pro.

Au général, sept modèles Anthropic s’installent dans le top 10

En septembre 2026, Anthropic domine le classement général d’Arena et place sept modèles parmi les dix premiers. Meta et Google suivent derrière. OpenAI hisse deux modèles, GPT‑5.6 Sol « high » et GPT‑5.5 « high », dans le top 20. Le top 20 toutes tâches confondues réunit, dans l’ordre, Claude Fable 5 « high », Claude Opus 4.6 « high », Claude Opus 4.7 « high », Muse Spark 1.2 « xhigh », Claude Fable 5.1 « max », Claude Opus 4.6, Claude Opus 4.7, Muse Spark 1.3 « max », Gemini 3.8 Flash « high », Claude Opus 5 « high », Muse Spark 1.1, Gemini 3.7 Flash « high », Muse Spark, Claude Opus 5 « max », Gemini 3.1 Pro, Gemini 3 Pro, Kimi K3 « max », GPT‑5.6 Sol « high », GLM 5.3 « max » et GPT‑5.5 « high ».

Par tâches, OpenAI s’impose en web et en image, Anthropic en vision et documents

Arena publie des classements par catégories en plus du général. OpenAI prend la tête du WebDev avec GPT‑6 Astra, présenté par l’entreprise comme son meilleur modèle à ce jour pour le développement logiciel, devant Claude Fable 5.1 Max puis Claude Opus 5 Max. En Analyse d’image, Claude Fable 5 arrive premier, suivi de Qwen 3.8 et de Claude Opus 4.7 « high », tandis que Meta aligne trois modèles dans le top 10. En Analyse de documents, Anthropic occupe les sept premières places, menées par Claude Opus 5, et trois modèles d’OpenAI complètent le top 10. Côté Génération d’images, les nouvelles variantes « flare » et « sunburst » de ChatGPT Images 2.5, déployées il y a quelques jours, prennent les deux premières places du Text‑to‑image, leur prédécesseur rétrogradant troisième, et MAI Image 2.6 de Microsoft se classe quatrième.

Brief IA — L'actualité IA en français

L'essentiel de l'actualité de l'intelligence artificielle, décrypté et expliqué chaque jour.