Brief IA : Anthropic réduit les coûts des fenêtres de contexte géantes

Anthropic réduit les coûts des fenêtres de contexte géantes

Brief IA
Tom Levy·2 min·3 vues

Anthropic a supprimé la surcharge pour les fenêtres de contexte d'un million de tokens dans les modèles Opus 4.6 et Sonnet 4.6, rendant leur utilisation beaucoup moins coûteuse. Les requêtes dépassant 200 000 tokens ne coûtent plus jusqu'à 100 % de plus, ce qui rend l'accès à ces modèles d'IA plus abordable pour les utilisateurs ayant des besoins de traitement de données étendus.

En bref
1Anthropic réduit drastiquement les coûts pour les fenêtres de contexte d'un million de tokens, supprimant la surcharge de 100 %.
2Les modèles Opus 4.6 et Sonnet 4.6 bénéficient désormais d'une tarification standard, indépendamment du nombre de tokens utilisés.
3La limite de médias par demande passe de 100 à 600 images ou pages PDF, élargissant les capacités des utilisateurs.
💡Pourquoi c'est importantCette réduction de coût rend les modèles d'IA d'Anthropic plus accessibles, favorisant leur adoption à grande échelle dans divers secteurs.
Le brief IA que lisent les pros

Tu suis la course aux modèles IA ?

Chaque sortie (GPT, Claude, Gemini, Mistral…) décryptée le soir même, en 5 min. Gratuit.

Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.

Choisis ton rythme

Gratuit · Pas de spam · Désabonnement en 1 clic

📄
L'analyse en français

Anthropic réduit les coûts pour les fenêtres de contexte d'un million de tokens

Anthropic a récemment annoncé une réduction significative des coûts associés à l'utilisation de fenêtres de contexte extra-larges dans ses modèles d'intelligence artificielle. Les modèles Opus 4.6 et Sonnet 4.6 peuvent désormais traiter jusqu'à un million de tokens sans frais supplémentaires, une avancée majeure par rapport à la surcharge de 100 % qui était appliquée pour les demandes dépassant 200 000 tokens.

Tarification et nouvelles limites

Malgré cette suppression de la surcharge, les prix de base des modèles restent inchangés : Opus 4.6 est facturé à 5 $/25 $ par million de tokens pour l'entrée et la sortie, tandis que Sonnet 4.6 est à 3 $/15 $. Désormais, que le prompt contienne 9 000 ou 900 000 tokens, le coût reste le même. En outre, la limite de médias par demande a été augmentée de 100 à 600 images ou pages PDF, élargissant ainsi les possibilités d'utilisation.

Disponibilité et performance

Cette nouvelle tarification est applicable aux utilisateurs de Claude Code dans ses versions Max, Team et Enterprise, et est accessible via des plateformes telles qu'Amazon Bedrock, Google Cloud Vertex AI et Microsoft Foundry (à l'exception de la limite de médias).

En termes de performance, le modèle Opus 4.6 a démontré une capacité à maintenir une performance stable même à pleine longueur de contexte, selon le benchmark GraphWalks BFS, qui évalue le raisonnement logique sur de grandes quantités de texte. Anthropic affirme que ses modèles atteignent une précision maximale parmi les modèles comparables lors des tests de référence, bien que le défi de la précision décroissante avec l'augmentation de la longueur de contexte reste un problème à résoudre.

Suivez Brief IA

L'actu IA du jour, aussi dans votre fil.

Commentaires