Brief IA : Anthropic Opus 4.7 : explosion des coûts en tokens

Anthropic Opus 4.7 : explosion des coûts en tokens

Brief IA
Tom Levy·2 min·7 vues

L'Opus 4.7 d'Anthropic, bien que présentant un coût par token identique à celui de son prédécesseur, génère 47 % de tokens supplémentaires par requête, entraînant une augmentation des coûts d'utilisation. Des mesures indiquent une hausse moyenne de 1.325x pour le contenu de Claude Code et jusqu'à 1.47x pour la documentation technique. Cette évolution pourrait influencer les décisions d'adoption des utilisateurs face à l'optimisation des dépenses en IA.

En bref
1L'Opus 4.7 d'Anthropic consomme plus de tokens par requête que le 4.6, malgré un prix affiché identique.
2Les mesures d'Abhishek Ray montrent une augmentation de consommation de tokens allant jusqu'à 1.47x pour certains contenus.
3Une évaluation communautaire révèle une hausse de 37.4 % des tokens et des coûts par requête sur 483 soumissions.
💡Pourquoi c'est importantLes utilisateurs d'Opus 4.7 pourraient voir leurs coûts réels augmenter, impactant les budgets alloués à l'utilisation de cette technologie.
Le brief IA que lisent les pros

Tu suis la course aux modèles IA ?

Chaque sortie (GPT, Claude, Gemini, Mistral…) décryptée le soir même, en 5 min. Gratuit.

Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.

Choisis ton rythme

Gratuit · Pas de spam · Désabonnement en 1 clic

📄
L'analyse en français

L'Opus 4.7, la dernière version du modèle d'intelligence artificielle d'Anthropic, présente une particularité intrigante : bien que son prix affiché reste inchangé par rapport à l'Opus 4.6, il consomme sensiblement plus de tokens par requête. Cette augmentation a été mise en lumière par Abhishek Ray lors du Claude Code Camp, où il a partagé ses observations sur cette nouvelle version.

Le guide de migration fourni par Anthropic mentionne une augmentation de la consommation de tokens allant de 1.0 à 1.35x. Les mesures effectuées par Ray confirment cette tendance, avec des chiffres qui s'inscrivent dans cette fourchette. Cependant, certains types de contenu dépassent ces valeurs : par exemple, le contenu réel de Claude Code affiche une augmentation moyenne de 1.325x, tandis qu'un fichier CLAUDE.md atteint 1.445x, et la documentation technique grimpe jusqu'à 1.47x.

Une évaluation communautaire, accessible sur le site tokens.billchambers.me, a compilé des données issues de 483 soumissions, révélant une augmentation de 37.4 % tant en termes de tokens utilisés que de coûts par requête lors de la transition de l'Opus 4.6 à la version 4.7.

Abhishek Ray a également noté que le code subit une augmentation plus marquée que la prose, tandis que les textes en chinois et en japonais semblent moins affectés. Pour une session d'échantillonnage de 80 tours, il estime que les coûts pourraient augmenter de 20 à 30 %, faisant passer la facture de 6,65 $ à une fourchette comprise entre 7,86 $ et 8,76 $.

Malgré cette hausse de consommation, l'Opus 4.7 offre des améliorations notables. Un test utilisant le benchmark IFEval sur 20 invites a montré que l'Opus 4.7 respecte les instructions strictes avec une fiabilité supérieure de cinq points de pourcentage par rapport à son prédécesseur.

Suivez Brief IA

L'actu IA du jour, aussi dans votre fil.

Commentaires