Brief IA : Claude Haiku 5.5 baisse ses prix et ajoute des crédits API

Claude Haiku 5.5 baisse ses prix et ajoute des crédits API

Brief IA
Tom Levy·4 min·4 vues

Anthropic a lancé Claude Haiku 5.5 avec une réduction des prix allant jusqu'à 90 % pour les requêtes de 100 000 jetons ou moins, et une baisse de 50 % du coût de lecture de cache de Sonnet 5.5, passant de 0,20 $ à 0,10 $ par million de jetons. De plus, des crédits API mensuels ont été introduits, allant jusqu'à 500 $ pour les abonnés Team, afin de rendre les charges à fort volume plus viables tout en renforçant la cybersécurité.

⚡
En bref
1Haiku 5.5 baisse jusqu’à 90 % les prix pour les invites ≤ 100 000 jetons et progresse nettement aux benchmarks.
2Anthropic réduit de 50 % le cache de Sonnet 5.5 (0,20 $ → 0,10 $/M jetons) et crée des crédits API mensuels.
3Garde-fous renforcés, tests de pénétration bloqués, disponibilité sur AWS, Google Cloud et Azure.
💡Pourquoi c'est important — ces baisses de coût et crédits API visent à rendre viables des charges à fort volume tout en cadrant les usages sensibles.
⚡Le brief IA que lisent les pros

L’IA appliquée, concrètement ?

Les cas d’usage qui marchent vraiment, décryptés chaque soir en 5 min. Gratuit.

Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.

Choisis ton rythme

Gratuit · Pas de spam · Désabonnement en 1 clic

Anthropic lance Claude Haiku 5.5 avec des tarifs par jeton en forte baisse par rapport à Haiku 4.5 et des progrès marqués aux benchmarks. En parallèle, l'éditeur réduit de 50 % le coût de lecture de cache de Sonnet 5.5 et crée des crédits API mensuels. Le modèle arrive sur les grands clouds et s'accompagne de garde-fous renforcés en cybersécurité.

Anthropic réduit de 50 % le cache de Sonnet 5.5 et crédite l’API

Anthropic réduit de 50 % le coût de lecture de cache de Sonnet 5.5, passant de 0,20 $ à 0,10 $ par million de jetons. Selon l'entreprise, cette mesure devrait permettre de diminuer d'environ 20 % le coût de la plupart des tâches agentiques. Anthropic introduit également des crédits API mensuels : 100 $ pour les abonnés Max-5x, 200 $ pour Max-20x et jusqu'à 500 $ par mois pour Team, utilisables pour tester des outils, applications et agents via l'API. Cette baisse de prix est présentée comme une réaction à la série GPT-6.1 d'OpenAI. Ces annonces s'ajoutent à la mise en place de crédits API pour les abonnés.

Haiku 5.5 abaisse le coût des requêtes jusqu’à 90 %

En moyenne, Haiku 5.5 coûte environ 75 % de moins que Haiku 4.5. Pour les requêtes de 100 000 jetons ou moins, qui constituent près de 90 % des requêtes antérieures de Haiku, les prix peuvent baisser jusqu'à 90 %. Les requêtes qui excèdent 100 000 jetons sont facturées à un tarif cinq fois supérieur. Le modèle fait appel à un tokenizer actualisé qui requiert un peu plus de jetons par opération, une situation déjà constatée sur Opus 4.x, avec une hausse d'environ 30 % due à la modification du tokenizer. Les économies réelles pourraient donc être inférieures à ce que suggèrent les prix par jeton. Haiku 5.5 est conçu pour des tâches à fort volume et sensibles aux coûts, comme les résumés, les requêtes de bases de données, la classification ou le support client en direct.

Benchmarks : de 735 à 1 620 sur GDPval, 72,4 % sur OSWorld

Sur le benchmark GDPval-AA v2.1, Haiku 5.5 atteint un score de 1 620, contre 735 pour Haiku 4.5. Pour l'utilisation autonome de l'ordinateur, le modèle obtient 72,4 % sur OSWorld-2.1, contre 15,7 % auparavant. Sur Terminal-Bench 4.0, Haiku 5.5 atteint 39,2 %, alors que Haiku 4.5 n'avait pas de score. À l'examen Humanity's Last Exam, Haiku 5.5 obtient 45,9 % sans outils et 57,4 % avec outils, contre 10,2 % et 18,7 % pour son prédécesseur.

Face à GPT-6 Luna et à Sonnet 5.5, un modèle à portée ciblée

Anthropic compare Haiku 5.5 au modèle économique GPT-6 Luna d'OpenAI et affirme qu'il le surpasse dans tous les domaines testés, notamment le codage agentique. Les scores de référence montrent cependant que Haiku 5.5 reste bien en deçà de Sonnet 5.5, le modèle plus grand d'Anthropic. Haiku 5.5 inaugure la possibilité d’ajuster les niveaux de raisonnement au sein de la gamme Haiku. D'après Anthropic, ce modèle convient davantage à des usages spécialisés comme la compaction, la synthèse ou les tâches de sous-agent, tandis que Sonnet 5.5 et Opus 5.5 sont recommandés pour le codage agentique complexe.

Clouds, sécurité renforcée et nouveaux SDK en bêta

Haiku 5.5 est disponible sur AWS, Google Cloud et Azure. Par rapport à la version précédente, les dispositifs de cybersécurité ont été renforcés et autorisent un éventail plus étendu de tâches défensives que Sonnet 5.5, ceci étant en partie lié à une moindre capacité générale du modèle. Les essais d'intrusion continuent d'être interdits. Les structures ayant des besoins plus étendus peuvent solliciter l'accès aux programmes de vérification d'Anthropic pour les sciences de la vie et la cybersécurité. Par ailleurs, les SDK Python et TypeScript sont mis à jour avec un support bêta pour l'utilisation d'ordinateurs et de navigateurs.

Suivez Brief IA

L'actu IA du jour, aussi dans votre fil.

Commentaires