Brief IA : Anthropic lance Opus 5.5 : performances Fable 5.1 à moindre coût

Anthropic lance Opus 5.5 : performances Fable 5.1 à moindre coût

Brief IA
Tom Levy·4 min·4 vues

Anthropic a lancé Claude Opus 5.5, offrant des performances équivalentes à Fable 5.1 tout en réduisant le prix des tokens de 20 % et en augmentant les quotas de 20 %. Ce modèle intègre des garde-fous renforcés et des évaluations externes, ce qui pourrait favoriser son adoption dans des secteurs exigeants, comme en témoignent les gains rapportés par des entreprises telles que Box, GitHub, Ramp et Deloitte.

En bref
1Anthropic lance Claude Opus 5.5, présenté avec des performances de niveau Fable 5.1 pour la plupart des usages
2Le prix des tokens baisse de 20 % et les quotas sur cinq heures augmentent de 20 %
3Des garde-fous renforcés et des évaluations externes sont annoncés, avec un routage automatique vers d'autres modèles sur des sujets sensibles
4Des entreprises comme Box, GitHub, Ramp et Deloitte rapportent des gains concrets en tokens, en étapes et en détection de bugs
💡Pourquoi c'est importantOpus 5.5 combine avancées techniques, réduction des coûts et dispositifs de sûreté, ce qui pourrait accélérer son adoption dans des secteurs exigeants.
Le brief IA que lisent les pros

Tu suis la course aux modèles IA ?

Chaque sortie (GPT, Claude, Gemini, Mistral…) décryptée le soir même, en 5 min. Gratuit.

Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.

Choisis ton rythme

Gratuit · Pas de spam · Désabonnement en 1 clic

📄
L'analyse en français

Anthropic rend disponible Claude Opus 5.5 et en revendique des performances de niveau Fable 5.1 pour la plupart des usages, avec des tarifs et des quotas revus à la baisse. L’éditeur met aussi en avant des garde-fous renforcés et des évaluations externes, tandis que des entreprises rapportent des gains mesurés sur le code et la productivité.

Garde-fous activables et évaluations externes annoncés

Anthropic décrit pour Opus 5.5 un dispositif de sûreté combinant des tests d’alignement approfondis, des évaluations pré‑lancement par des organisations extérieures et des garde‑fous dédiés à des domaines à haut risque comme la cybersécurité et la biologie. L’éditeur se réfère à des positions exprimées par son PDG Dario Amodei sur la modulation de la vitesse des avancées en capacités d’IA. Selon Anthropic, Opus 5.5 est le modèle le plus performant qu’ils aient testé à ce jour, avec des progrès sur des comportements associés à des incidents récents en cybersécurité, notamment le raisonnement biaisé ou des tentatives d’évasion d’un environnement contrôlé. L’entreprise dit avoir eu recours à des fournisseurs de tests externes et à une classe de garde‑fous similaire à celle de Fable 5.1 pour la cybersécurité, la biologie et le développement de LLM de pointe. Lorsque ces garde‑fous se déclenchent, les requêtes sont automatiquement routées d’Opus 5.5 vers Opus 4.8. En pratique, la plupart des tâches de cybersécurité seront redirigées vers Opus 4.8, tandis que les demandes liées à la biologie et au développement de LLM seront transmises à Opus 5. Des organisations vérifiées peuvent solliciter le Programme de Vérification des Sciences de la Vie pour un accès renforcé en recherche biologique. Celles approuvées dans le cadre du Programme de Vérification Cyber pourront commencer à utiliser Opus 5.5 dans quelques semaines.

Tarifs des tokens et quotas d’abonnement revus à la baisse

Anthropic baisse le prix des tokens de 20 % par rapport à Opus 5 et affirme qu’Opus 5.5 consomme moins de tokens pour produire un travail de meilleure qualité. Pour les abonnés, les limites d’utilisation sur cinq heures augmentent de 20 %. L’éditeur ajoute que les plafonds sur cinq heures et à la semaine deviennent plus efficaces puisque l’utilisation d’Opus 5.5 coûte moins que celle d’Opus 5. Les plans à 20 $ par mois sont concernés par ces mécanismes.

Performances revendiquées : vitesse accrue et style plus naturel

Anthropic positionne Opus 5.5 avec des performances proches de Fable 5.1 pour la plupart des tâches, à un coût environ 40 % inférieur. Le modèle est disponible immédiatement, moins de deux mois après Opus 5. L’éditeur avance aussi un modèle plus sûr, moins coûteux et moins verbeux que ses prédécesseurs, et indique que la génération de résultats est plus de 30 % plus rapide qu’avec Opus 5. Pour mémoire, Opus 5 avait été présenté avec des performances proches de Fable à moitié prix. Anthropic affirme en outre qu’Opus 5.5 communique de façon plus naturelle que les versions précédentes.

Retours d’entreprises : tokens en baisse et tâches résolues plus vite

Chez Box, les évaluations menées rapportent qu’Opus 5.5 a consommé un tiers des tokens utilisés par Opus 5, avec des réponses 40 % moins verbeuses sans perte de précision. Box rappelle que vitesse et coût sont décisifs pour traiter de grandes quantités de contenu et estime que ces gains compteront pour les équipes qui gèrent des agents dans des secteurs comme la finance ou le public. Du côté de GitHub, des tests via Copilot CLI et VS Code indiquent qu’Opus 5.5 fait partie des modèles utilisant le moins de tokens et d’étapes mesurés ; dans VS Code, il a résolu plus de tâches terminales qu’Opus 5 en moins de la moitié des étapes. Ces résultats sont présentés comme rendant des projets plus ambitieux plus abordables pour les développeurs.

Qualité de sortie et détection de bugs selon Ramp et Deloitte

Chez Ramp, un ingénieur logiciel décrit la fin des sorties inutilement verbeuses et une écriture conforme à leurs règles internes ; une spécification de conception générée a été utilisable avec très peu de retouches, la réécriture d’un prompt a été préférée à l’originale, et l’optimisation d’une suite de tests a permis d’expédier un changement en confiance. Deloitte Consulting LLP rapporte qu’au réglage d’effort le plus bas, Opus 5.5 a détecté 72 % des bugs connus en revue de code, contre 56 % pour Opus 5 à effort élevé, avec moins de faux positifs et une fraction de la sortie. Lors d’une analyse de consultation aux États‑Unis, un effort de faible réflexion a égalé des réglages plus élevés avec la moitié de la sortie et a passé les contrôles de qualité.

Prochaines étapes : Sonnet 5.5 et Haiku 5.5 annoncés

Anthropic prévoit de lancer Claude Sonnet 5.5 et Haiku 5.5 dans les semaines à venir.

Suivez Brief IA

L'actu IA du jour, aussi dans votre fil.

Commentaires