Brief IA : Gemini 3.8 Flash : coût par token stable, usage potentiellement plus cher

Gemini 3.8 Flash : coût par token stable, usage potentiellement plus cher

Brief IA
Tom Levy·3 min·2 vues

Google a lancé Gemini 3.8 Flash avec un tarif par token inchangé à 0,75 $ pour l'entrée et 3,75 $ pour la sortie, tout en avertissant que le modèle pourrait consommer plus de tokens. Le Fairwind Program, qui compte 650 membres, donne accès à une version cyber de Gemini 3.8 Flash, destinée aux gouvernements et partenaires de confiance, et intègre des mesures de protection contre les abus et les cyberattaques.

En bref
1Le Fairwind Program, limité aux gouvernements et partenaires de confiance, compte 650 membres et donne accès à 3.8 Flash Cyber et à CodeMender.
2Le prix par token reste à 0,75 $ (entrée) et 3,75 $ (sortie), mais Google prévient que le modèle peut consommer plus de tokens.
33.8 Flash surpasse ses concurrents sur plusieurs benchmarks et est disponible avec les abonnements Google AI Pro ou Ultra.
💡Pourquoi c'est importantLes utilisateurs pourraient payer davantage malgré un tarif par token inchangé.
Le brief IA que lisent les pros

Tu suis la course aux modèles IA ?

Chaque sortie (GPT, Claude, Gemini, Mistral…) décryptée le soir même, en 5 min. Gratuit.

Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.

Choisis ton rythme

Gratuit · Pas de spam · Désabonnement en 1 clic

📄
L'analyse en français

Google commercialise Gemini 3.8 Flash avec le même prix par token que 3.7, tout en prévenant que le modèle peut consommer davantage de tokens. La société met en avant des résultats supérieurs sur plusieurs benchmarks et lance une déclinaison cyber réservée à un programme d'accès limité.

La déclinaison cyber passe par un programme restreint

Google a lancé en parallèle Gemini 3.8 Flash Cyber et le Fairwind Program. Ce dispositif est limité aux gouvernements et à des partenaires de confiance et compte 650 membres, parmi lesquels CrowdStrike et le Center for Internet Security. Il donne accès à 3.8 Flash Cyber et à l’agent CodeMender, que Google présente comme capable de trouver et corriger de manière autonome des vulnérabilités pour protéger des infrastructures critiques, des services publics et la sécurité nationale. Google indique aussi que Gemini 3.8 Flash intègre des mesures de protection contre les abus dans les domaines chimique, biologique, radiologique et nucléaire (CBRN) ainsi que contre les cyberattaques.

Tarif inchangé, facture variable selon l’usage de tokens

Le tarif d’introduction demeure de 0,75 $ par million de tokens d’entrée et 3,75 $ par million de tokens de sortie, identique à 3.7 Flash. Google avertit toutefois que le modèle peut utiliser plus de tokens pour maximiser la performance, notamment aux niveaux d’effort élevés, ce qui peut augmenter la facture. Les développeurs peuvent continuer à recourir à 3.7 Flash s’ils veulent minimiser cette consommation. Artificial Analysis estime que 3.8 Flash est le moins cher mesuré à ce niveau d’intelligence, tout en rapportant environ 40 % d’augmentation du coût par rapport à 3.7 Flash, liée à 30 % de tokens de sortie en plus par tâche et à davantage de tours lors des évaluations agentiques.

Benchmarks et comparaisons face à Anthropic

Google met en avant des améliorations pour l’ingénierie logicielle et les agents autonomes, avec des résultats supérieurs sur DeepSWE v1.1 par rapport à son précédent modèle et à d’autres références, dont Fable 5 d’Anthropic. Selon les tests, le dernier modèle a également obtenu de meilleurs scores que ses rivaux sur Vals Finance Agent V2 ainsi que sur Harvey’s Legal Agent. Anthropic a procédé à une mise à jour de Fable 5 en début de semaine et annonce des performances accrues pour un coût plus bas grâce à une diminution du prix d’utilisation des données en cache. John Ennis, qui dirige Aigora.ai, estime que 3.8 Flash délivre une qualité de codage Opus 5 à une fraction du coût et très rapidement, citant des usages possibles comme la création de vidéos de remotion.

Disponibilité et positionnement fonctionnel

Gemini 3.8 Flash a été lancé quelques semaines après 3.7 Flash. Il est accessible aux consommateurs via les abonnements Google AI Pro ou Ultra, ainsi qu’aux développeurs et aux entreprises. Google affirme que le modèle « travaille plus dur » que son prédécesseur en multipliant les étapes de raisonnement sur des tâches complexes et en appelant des outils de manière itérative.

Suivez Brief IA

L'actu IA du jour, aussi dans votre fil.

Commentaires