Brief IA : Anthropic publie Opus 5.5, baisse de prix et garde-fous renforcés

Anthropic publie Opus 5.5, baisse de prix et garde-fous renforcés

Brief IA
Tom Levy·3 min·13 vues

Anthropic a lancé Opus 5.5, un modèle d'IA avec des restrictions de sécurité équivalentes à celles de Fable, évalué par METR et Frontier Design. Proposé à 20 $ par million de tokens de sortie, il est plus rapide et revendique des performances supérieures à Fable sur de nombreux benchmarks. Des versions Sonnet 5.5 et Haiku 5.5 sont attendues dans les semaines à venir.

En bref
1Opus 5.5 est lancé avec des restrictions de sécurité équivalentes à Fable et une évaluation externe par METR et Frontier Design
2Le modèle est proposé à 20 $ par million de tokens de sortie, contre 25 $ auparavant, et s’exécute plus rapidement
3Anthropic revendique des performances supérieures à Fable sur de nombreux benchmarks et une comparabilité à Mythos en biologie et cybersécurité
4Sonnet 5.5 et Haiku 5.5 sont annoncés pour les prochaines semaines avec des améliorations similaires
💡Pourquoi c'est importantOpus 5.5 marque une avancée technique tout en renforçant les mesures de sécurité, dans un contexte de surveillance accrue du développement de l’IA.
Le brief IA que lisent les pros

Tu veux les meilleurs outils IA avant les autres ?

On teste et on décrypte les nouveaux outils IA chaque soir, en 5 min. Gratuit.

Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.

Choisis ton rythme

Gratuit · Pas de spam · Désabonnement en 1 clic

📄
L'analyse en français

Anthropic lance Opus 5.5 avec des restrictions de sécurité alignées sur Fable et une évaluation externe par METR et Frontier Design. Le modèle est annoncé plus rapide et moins cher que son prédécesseur, avec 20 $ par million de tokens de sortie. L’entreprise revendique des performances supérieures à Fable sur de nombreux tests et une communication retravaillée. Des versions Sonnet 5.5 et Haiku 5.5 doivent suivre dans les semaines à venir.

Des contrôles équivalents à Fable et une montée en puissance de la régulation

La sortie d’Opus 5.5 s’accompagne des mêmes garde‑fous que ceux appliqués au modèle Fable. Ces mesures limitent notamment l’usage du système pour chercher des vulnérabilités dans des programmes compilés ou pour développer des armes biologiques reconnaissables, et couvrent d’autres tâches sensibles. La formation à la sécurité est restée proche de celle des précédents modèles, avec des tests d’alignement et une évaluation pré‑lancement conduite par des organisations extérieures, dont METR et Frontier Design. Anthropic prépare par ailleurs des dispositifs de formation et d’évaluation plus avancés pour ses futurs modèles, incluant des systèmes de sécurité et de surveillance améliorés. L’entreprise soutient que la politique publique devra peser davantage à mesure que les systèmes gagnent en capacité, indique que cette compétence se construit dans la durée et affirme avoir commencé à mettre en place l’infrastructure correspondante. Elle prévoit de détailler ces travaux prochainement. Ce lancement intervient après la décision de Dario Amodei de ralentir délibérément l’augmentation des capacités pour rester au rythme des avancées en alignement, démarche qu’il a justifiée ce mois‑ci en appelant à plus de prudence et à un ajustement du rythme des progrès autant qu’à l’investissement dans la prévention des risques.

Capacités revendiquées et comparaisons avec Fable et Mythos

Anthropic présente Opus 5.5 comme établissant un nouvel état de l’art pour le codage et le travail de connaissance, et affirme qu’il dépasse Fable sur de nombreux benchmarks tout en réussissant des tâches informelles qui avaient échappé à ce dernier. L’entreprise le dit comparable à Mythos en biologie et en cybersécurité. Au registre de l’usage, Opus 5.5 est annoncé moins jargonneux et davantage enclin à placer l’essentiel en tête de message.

Tarifs revus à la baisse et exécution plus rapide

Opus 5.5 est proposé à 20 $ par million de tokens de sortie, contre 25 $ pour la génération précédente, et d’autres indicateurs tarifaires suivent la même tendance. Le modèle s’exécute plus rapidement, ce qui reflète une baisse générale des ressources de calcul nécessaires à son fonctionnement.

Calendrier serré et prochaine vague de la gamme Claude

Le lancement a eu lieu un mardi, deux mois après la sortie d’Opus 5 du 24 juillet, confirmant un rythme rapproché. Dans la gamme Claude, Opus demeure le niveau le plus capable et le plus coûteux, Sonnet l’intermédiaire et Haiku le plus rapide et le plus économique. Anthropic annonce que Sonnet 5.5 et Haiku 5.5 arriveront dans les semaines à venir, avec des améliorations de performance du même ordre.

Suivez Brief IA

L'actu IA du jour, aussi dans votre fil.

Commentaires