Tu suis la course aux modèles IA ?
Chaque sortie (GPT, Claude, Gemini, Mistral…) décryptée le soir même, en 5 min. Gratuit.
Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.
Choisis ton rythme
Gratuit · Pas de spam · Désabonnement en 1 clic
Anthropic réduit les coûts pour les fenêtres de contexte d'un million de tokens
Anthropic a récemment annoncé une réduction significative des coûts associés à l'utilisation de fenêtres de contexte extra-larges dans ses modèles d'intelligence artificielle. Les modèles Opus 4.6 et Sonnet 4.6 peuvent désormais traiter jusqu'à un million de tokens sans frais supplémentaires, une avancée majeure par rapport à la surcharge de 100 % qui était appliquée pour les demandes dépassant 200 000 tokens.
Tarification et nouvelles limites
Malgré cette suppression de la surcharge, les prix de base des modèles restent inchangés : Opus 4.6 est facturé à 5 $/25 $ par million de tokens pour l'entrée et la sortie, tandis que Sonnet 4.6 est à 3 $/15 $. Désormais, que le prompt contienne 9 000 ou 900 000 tokens, le coût reste le même. En outre, la limite de médias par demande a été augmentée de 100 à 600 images ou pages PDF, élargissant ainsi les possibilités d'utilisation.
Disponibilité et performance
Cette nouvelle tarification est applicable aux utilisateurs de Claude Code dans ses versions Max, Team et Enterprise, et est accessible via des plateformes telles qu'Amazon Bedrock, Google Cloud Vertex AI et Microsoft Foundry (à l'exception de la limite de médias).
En termes de performance, le modèle Opus 4.6 a démontré une capacité à maintenir une performance stable même à pleine longueur de contexte, selon le benchmark GraphWalks BFS, qui évalue le raisonnement logique sur de grandes quantités de texte. Anthropic affirme que ses modèles atteignent une précision maximale parmi les modèles comparables lors des tests de référence, bien que le défi de la précision décroissante avec l'augmentation de la longueur de contexte reste un problème à résoudre.



