Brief IA : Anthropic dévoile Opus 4.7 : l'IA qui surpasse ses rivales

Anthropic dévoile Opus 4.7 : l'IA qui surpasse ses rivales

Brief IA
Tom Levy·3 min·10 vues

Anthropic a lancé Claude Opus 4.7, un modèle d'IA amélioré pour la programmation et le traitement d'images, offrant des performances supérieures à ses prédécesseurs. Ce modèle atteint 64,3% sur le benchmark SWE-bench Pro, contre 53,4% pour Opus 4.6, renforçant ainsi la position d'Anthropic sur le marché de l'IA et répondant à des besoins croissants en développement logiciel.

En bref
1Anthropic dévoile Claude Opus 4.7, un modèle d'IA amélioré pour la programmation et l'analyse d'images haute résolution.
2Opus 4.7 atteint 64,3% sur le benchmark SWE-bench Pro, surpassant GPT-5.4 et Gemini 3.1 Pro.
3Le modèle gère des tâches complexes avec une fenêtre de contexte d'un million de tokens et analyse des images jusqu'à 2 576 pixels.
💡Pourquoi c'est importantOpus 4.7 renforce la position d'Anthropic dans la compétition IA, tout en testant des innovations à grande échelle pour des applications professionnelles avancées.
Le brief IA que lisent les pros

Tu suis la course aux modèles IA ?

Chaque sortie (GPT, Claude, Gemini, Mistral…) décryptée le soir même, en 5 min. Gratuit.

Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.

Choisis ton rythme

Gratuit · Pas de spam · Désabonnement en 1 clic

📄
L'analyse en français

Anthropic dévoile Opus 4.7 : un modèle d'IA avancé

Anthropic continue d'accélérer dans le domaine de l'intelligence artificielle avec le lancement de Claude Opus 4.7. Ce modèle, conçu pour les utilisateurs professionnels, se distingue par ses performances améliorées en programmation et sa capacité à traiter des images en haute résolution. Depuis plusieurs mois, Anthropic multiplie les versions de ses modèles Claude pour rester compétitif face à des géants comme OpenAI et Google. À peine deux mois après la sortie d'Opus 4.6, l'entreprise présente Opus 4.7 comme son modèle public le plus performant à ce jour.

Performances remarquables sur les benchmarks

Dans son communiqué, Anthropic met en avant les améliorations mesurables d'Opus 4.7 sur les benchmarks de référence. Sur le test SWE-bench Pro, qui évalue les performances des modèles en programmation agentique, Opus 4.7 atteint un score de 64,3%, surpassant ainsi Opus 4.6 qui avait obtenu 53,4%. Ce score place également Opus 4.7 devant des modèles concurrents tels que GPT-5.4 avec 57,7% et Gemini 3.1 Pro avec 54,2%.

Sur le benchmark SWE-bench Verified, Opus 4.7 obtient un score impressionnant de 87,6%, et il atteint 94,2% sur GPQA Diamond, un test de raisonnement avancé au niveau doctoral. Au-delà des performances brutes, Anthropic souligne que le modèle a amélioré sa capacité à suivre précisément les instructions et à vérifier ses réponses avant de les fournir.

Conçu pour des tâches longues et complexes

Opus 4.7 est particulièrement adapté aux usages "agentiques", c'est-à-dire des systèmes capables de réaliser des tâches complexes avec peu de supervision humaine. Selon Anthropic, le modèle peut gérer des projets multi-étapes sur une longue durée tout en conservant une cohérence sur une fenêtre de contexte pouvant atteindre un million de tokens. Cette capacité lui permet de travailler sur des projets volumineux, comme le développement logiciel ou l'analyse documentaire.

La vision multimodale du modèle a également été renforcée. Opus 4.7 peut désormais analyser des images jusqu'à 2 576 pixels sur le bord long, soit plus de trois fois la résolution acceptée par les précédents modèles Claude. Cela ouvre la voie à des usages comme l'analyse de captures d'écran complexes ou l'extraction de données depuis des diagrammes détaillés.

Une stratégie en deux niveaux

Malgré ces avancées, Anthropic précise qu'Opus 4.7 n'est pas son modèle le plus puissant. En interne, l'entreprise dispose d'un système plus avancé appelé Mythos, actuellement réservé à un nombre limité de partenaires dans le cadre du programme de cybersécurité Project Glasswing. Ce modèle afficherait des performances encore supérieures, notamment dans les tâches liées à la sécurité informatique. Toutefois, Anthropic a choisi de limiter sa diffusion afin de mieux contrôler les risques liés à ces capacités.

Dans cette stratégie, Opus 4.7 joue donc un rôle intermédiaire : il permet de déployer certaines innovations à grande échelle tout en testant les garde-fous nécessaires avant une éventuelle diffusion de modèles encore plus puissants. Disponible dès maintenant via l'API Claude, Amazon Bedrock, Vertex AI ou Microsoft Foundry, le modèle conserve la même tarification que son prédécesseur : 5 dollars par million de tokens en entrée et 25 dollars en sortie.

Suivez Brief IA

L'actu IA du jour, aussi dans votre fil.

Commentaires