Brief IA : Google sort Gemini 3.8 Flash avec des tâches plus coûteuses

Google sort Gemini 3.8 Flash avec des tâches plus coûteuses

Brief IA
Tom Levy·5 min·9 vues

Google a lancé Gemini 3.8 Flash, successeur de 3.7, avec des performances améliorées en codage et une robustesse accrue, selon des mesures internes et d'Artificial Analysis. Bien que le tarif par token reste à 0,75 $ en entrée et 3,75 $ en sortie, le coût par tâche a augmenté d'environ 40 %, atteignant 0,58 $ par tâche. La version Cyber, qui atteint 86,2 % sur CyberGym, est réservée à des acteurs vérifiés via le programme Fairwind.

En bref
1Gemini 3.8 Flash succède à 3.7 trois semaines après, avec de meilleurs scores de codage et une robustesse accrue selon Google et Artificial Analysis
2Le tarif par token reste à 0,75 $ en entrée et 3,75 $ en sortie, mais le coût par tâche augmente d’environ 40 %
3La version Cyber atteint 86,2 % sur CyberGym et reste réservée à des acteurs vérifiés via le programme Fairwind
💡Pourquoi c'est importantGemini 3.8 Flash améliore les performances sur plusieurs benchmarks, mais la hausse du coût par tâche et l’accès restreint à la version Cyber imposent des choix d’usage et de configuration.
Le brief IA que lisent les pros

Tu suis la course aux modèles IA ?

Chaque sortie (GPT, Claude, Gemini, Mistral…) décryptée le soir même, en 5 min. Gratuit.

Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.

Choisis ton rythme

Gratuit · Pas de spam · Désabonnement en 1 clic

📄
L'analyse en français

Google ajoute Gemini 3.8 Flash à sa série de modèles économiques, trois semaines après la version 3.7. Les mesures internes et indépendantes le créditent de meilleurs résultats en codage et d’une meilleure robustesse, avec un prix par token inchangé. Mais le coût par tâche grimpe et la déclinaison Cyber reste réservée à des acteurs vérifiés.

Mesures indépendantes : coût par tâche +40 % et 2,5 minutes en moyenne

Artificial Analysis attribue à Gemini 3.8 Flash un Intelligence Index de 59, contre 56 pour 3.7 Flash. GPT-5.6 Sol en mode de raisonnement élevé et Grok 4.6 en mode moyen obtiennent également un score de 59. Selon Artificial Analysis, ce gain provient surtout d'une meilleure performance sur des tâches agentiques comme l'utilisation d'outils et le codage. Pour le coût, 3.8 Flash atteint la frontière de Pareto avec 0,58 $ par tâche, ce qui en fait le modèle le moins cher à ce niveau d'intelligence, mais ce montant est environ 40 % plus élevé que les 0,40 $ mesurés pour 3.7 Flash, alors que le prix par token n'a pas changé. Lorsqu'il s'agit de tâches nécessitant un raisonnement avancé, 3.8 Flash produit près de 300 tokens par seconde en sortie et le temps moyen pour chaque tâche est de 2,5 minutes. Cette durée est un peu inférieure à celle de GPT-5.6 Luna (2,6 minutes) et GPT-5.6 Terra (3,3 minutes), mais reste supérieure à Claude Fable 5.1 (2,1 minutes) et à 3.7 Flash (2,2 minutes). En abaissant le niveau de raisonnement, la durée moyenne tombe à environ 48 secondes.

Cybersécurité : accès via Fairwind et 86,2 % sur CyberGym

Gemini 3.8 Flash Cyber n'est pas proposé au public et son accès se fait par le biais du Fairwind Program, destiné aux agences gouvernementales, aux opérateurs d'infrastructures critiques et aux responsables de la maintenance logicielle. Cette version utilise des règles de sécurité moins strictes que la version classique, car elle cible des applications en cybersécurité défensive. Pour le benchmark CyberGym consacré à la détection de vulnérabilités dans le code C/C++, Google indique un résultat de 86,2 %, ce qui dépasse 3.5 Flash Cyber (77,5 %), GPT-5.6 Sol (83,6 %) et GPT-5.5-Cyber (85,6 %). Sur l'évaluation externe CWE-Bench pour le patching automatisé, le modèle atteint 47,2 % Pass@1, proche du niveau de référence à 47,8 %, avec un coût beaucoup plus faible. Concernant la robustesse face aux attaques par injection de prompt, Gemini 3.8 Flash affiche 5,5 % de réussite d'attaque sur Gray Swan IPI. DeepSeek V4 Pro, Kimi K3 et Grok 4.6 sont mesurés à 60,1 %, 52,7 % et 51,8 %. Claude Opus 5 descend à 4,8 %, et ses options de sécurité renforcées abaissent encore ce score dans l'écosystème Claude.

Prix par token inchangé mais plus de tokens consommés

Gemini 3.8 Flash conserve un tarif de lancement à 0,75 $ par million de tokens d'entrée et 3,75 $ par million de tokens de sortie, identique à 3.7 Flash. Google prévoit un passage au prix régulier de 1,50 $ et 7,50 $ à partir de janvier 2027. À titre de comparaison, Claude Opus 5 est facturé 5,00 $ en entrée et 25,00 $ en sortie, et GPT-5.6 Sol 4,00 $ et 20,00 $. Même après la fin des tarifs promotionnels, le coût par token de 3.8 Flash resterait inférieur à celui des modèles phares d'OpenAI et d'Anthropic. Google explique que les gains de performance de 3.8 Flash proviennent en partie d'étapes de raisonnement supplémentaires et d'appels d'outils itératifs, ce qui augmente la consommation de tokens et peut atténuer l'avantage tarifaire par token. Pour des charges de travail où l'efficacité de calcul prime, Google recommande de réduire le niveau de raisonnement ou d'opter pour 3.7 Flash, toujours supporté.

Positionnement : cadence accélérée, benchmarks en hausse, 3D en démonstration

Trois semaines après 3.7 Flash, Google introduit Gemini 3.8 Flash en deux versions, généraliste et Cyber, dans une série de trois lancements Flash en six semaines, alors que Gemini 3.5 Pro et Gemini 4 ne sont pas disponibles. Koray Kavukcuoglu, responsable de DeepMind, indique que Google vise aussi l'excellence en capacité brute. Sur DeepSWE v1.1, Google annonce 73,7 % pour 3.8 Flash, proche de Claude Opus 5 (74,0 %), au-dessus de GPT-5.6 Sol (72,7 %) et en progrès sur 3.7 Flash (65,3 %), tandis que Claude Sonnet 5 est mesuré à 53,8 %. Selon Google, 3.8 Flash obtient de meilleurs résultats qu'Opus 5 et GPT-5.6 Sol sur de nombreux benchmarks, tout en étant nettement moins onéreux, tout en soulignant que les performances sur benchmarks ne reflètent pas toujours l'usage concret. Google met également en avant des progrès en génération 3D, illustrés par la création d'un jeu à partir d'un unique prompt dans Antigravity, avec des textures générées par le modèle d'image Nano Banana.

Accès développeurs, entreprises et grand public

Les développeurs peuvent utiliser Gemini 3.8 Flash via Google AI Studio, Google Antigravity et Android Studio. Les entreprises y accèdent à travers Gemini Enterprise. Pour les particuliers, le modèle est disponible dans l'application Gemini, en mode IA de Google Search, et dans Google Sheets pour les abonnés payants.

Suivez Brief IA

L'actu IA du jour, aussi dans votre fil.

Commentaires