🧠 AnalyseModels📧 Substack · il y a 2j
«Claude Opus 5 est le nouveau leader de notre benchmark de travail de connaissance agentique, AA-Briefcase, surpassant Claude Fable 5 de près de 150 Elo tout en réduisant le coût par tâche de 20%.»

Citation originale

Claude Opus 5 is the new leader on our agentic knowledge work benchmark, AA-Briefcase, outperforming Claude Fable 5 by nearly 150 Elo while reducing Cost per Task by 20%.

S"

Shawn "swyx" Wang

Co-host Latent Space · Latent Space · US

Pourquoi ça compte

La sortie de Claude Opus 5 marque une avancée significative dans l'évaluation des modèles d'IA, soulignant l'importance de l'efficacité et des performances en conditions réelles en 2026.

Source

www.latent.space

Voir la source
📬 Newsletter gratuite

Ne rate rien de l'actu IA

Reçois chaque soir les 7 meilleures actus IA, décryptées en 5 min. Gratuit.

Le brief IA que lisent les pros

Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.

Chaque soir à 19h

Gratuit · Pas de spam · Désabonnement en 1 clic

Autres prises de parole de Shawn "swyx" Wang

← Tous les hot takes IA