Tu veux les meilleurs outils IA avant les autres ?
On teste et on décrypte les nouveaux outils IA chaque soir, en 5 min. Gratuit.
Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.
Choisis ton rythme
Gratuit · Pas de spam · Désabonnement en 1 clic
Anthropic annonce Opus 5.5, présenté comme plus rapide et 40 % moins cher que l’Opus 5, avec une approche d’alignement différente. Après une semaine d’essais, une utilisatrice décrit des tâches agentiques au long cours, un refus net du modèle et une capacité inattendue, tout en maintenant des réserves.
Sécurité en pratique et comportements en exécution
Claire Vo rapporte qu'Opus 5.5 a opposé un refus clair lors d'une demande, ce qui lui a permis d'observer la posture de sécurité d'Anthropic en situation réelle. Parmi quatre tâches agentiques de longue durée, elle indique qu'une tentative de manipulation a eu lieu pendant l'exécution. Ses essais comprenaient également un cas distinct de refus très ferme du modèle. Malgré les améliorations constatées, elle mentionne que deux aspects continuent de l'irriter.
Prix, vitesse et place face à Codex
Anthropic présente Opus 5.5 comme 40 % moins cher que l’Opus 5 et plus rapide, en mettant en avant une approche d’alignement différente. Après une semaine d’essais, Claire Vo précise où Codex reste supérieur et décrit comment elle répartit désormais sa pile de modèles, alors qu'elle avait auparavant transféré la majorité de son travail quotidien vers Codex. Le lancement d’Opus 5.5 modifie ainsi son environnement de travail, sans faire disparaître les avantages qu'elle attribue encore à Codex.
Cas d’usage testés et capacités mises en avant
Durant une semaine consacrée à des essais sur des projets concrets, Claire Vo a réalisé quatre missions agentiques de longue durée, repensé entièrement la page d’accueil de ChatPRD et effectué un test comparatif sur le format SVG. Elle indique avoir sélectionné Opus 5.5 comme solution de prédilection pour le prototypage frontend, tout en mentionnant des motifs de déception persistants. Un test vocal a été réalisé pour évaluer si le modèle se montre moins agaçant, et d'autres volets ont porté sur le prototypage, l’écriture de voix et d’e-mails, les illustrations SVG et le montage vidéo. Elle rapporte de nombreux points positifs et évoque une capacité inattendue qu’aucun autre modèle de sa pile ne propose. Elle détaille également des calculs de coût, estimant que le prix compte davantage pour des travaux agentiques que pour des prompts uniques. L’épisode se conclut par un verdict nuancé sur les points forts et faibles d’Opus 5.5. Les outils cités incluent Claude Opus 5.5, ElevenLabs MCP connector et Codex, et une partie de l’analyse aborde la sécurité, l’alignement et les limites en cybersécurité.






