Tu suis la course aux modèles IA ?
Chaque sortie (GPT, Claude, Gemini, Mistral…) décryptée le soir même, en 5 min. Gratuit.
Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.
Choisis ton rythme
Gratuit · Pas de spam · Désabonnement en 1 clic
Google ajoute Gemini 3.8 Flash à sa série de modèles économiques, trois semaines après la version 3.7. Les mesures internes et indépendantes le créditent de meilleurs résultats en codage et d’une meilleure robustesse, avec un prix par token inchangé. Mais le coût par tâche grimpe et la déclinaison Cyber reste réservée à des acteurs vérifiés.
Mesures indépendantes : coût par tâche +40 % et 2,5 minutes en moyenne
Artificial Analysis attribue à Gemini 3.8 Flash un Intelligence Index de 59, contre 56 pour 3.7 Flash. GPT-5.6 Sol en mode de raisonnement élevé et Grok 4.6 en mode moyen obtiennent également un score de 59. Selon Artificial Analysis, ce gain provient surtout d'une meilleure performance sur des tâches agentiques comme l'utilisation d'outils et le codage. Pour le coût, 3.8 Flash atteint la frontière de Pareto avec 0,58 $ par tâche, ce qui en fait le modèle le moins cher à ce niveau d'intelligence, mais ce montant est environ 40 % plus élevé que les 0,40 $ mesurés pour 3.7 Flash, alors que le prix par token n'a pas changé. Lorsqu'il s'agit de tâches nécessitant un raisonnement avancé, 3.8 Flash produit près de 300 tokens par seconde en sortie et le temps moyen pour chaque tâche est de 2,5 minutes. Cette durée est un peu inférieure à celle de GPT-5.6 Luna (2,6 minutes) et GPT-5.6 Terra (3,3 minutes), mais reste supérieure à Claude Fable 5.1 (2,1 minutes) et à 3.7 Flash (2,2 minutes). En abaissant le niveau de raisonnement, la durée moyenne tombe à environ 48 secondes.
Cybersécurité : accès via Fairwind et 86,2 % sur CyberGym
Gemini 3.8 Flash Cyber n'est pas proposé au public et son accès se fait par le biais du Fairwind Program, destiné aux agences gouvernementales, aux opérateurs d'infrastructures critiques et aux responsables de la maintenance logicielle. Cette version utilise des règles de sécurité moins strictes que la version classique, car elle cible des applications en cybersécurité défensive. Pour le benchmark CyberGym consacré à la détection de vulnérabilités dans le code C/C++, Google indique un résultat de 86,2 %, ce qui dépasse 3.5 Flash Cyber (77,5 %), GPT-5.6 Sol (83,6 %) et GPT-5.5-Cyber (85,6 %). Sur l'évaluation externe CWE-Bench pour le patching automatisé, le modèle atteint 47,2 % Pass@1, proche du niveau de référence à 47,8 %, avec un coût beaucoup plus faible. Concernant la robustesse face aux attaques par injection de prompt, Gemini 3.8 Flash affiche 5,5 % de réussite d'attaque sur Gray Swan IPI. DeepSeek V4 Pro, Kimi K3 et Grok 4.6 sont mesurés à 60,1 %, 52,7 % et 51,8 %. Claude Opus 5 descend à 4,8 %, et ses options de sécurité renforcées abaissent encore ce score dans l'écosystème Claude.
Prix par token inchangé mais plus de tokens consommés
Gemini 3.8 Flash conserve un tarif de lancement à 0,75 $ par million de tokens d'entrée et 3,75 $ par million de tokens de sortie, identique à 3.7 Flash. Google prévoit un passage au prix régulier de 1,50 $ et 7,50 $ à partir de janvier 2027. À titre de comparaison, Claude Opus 5 est facturé 5,00 $ en entrée et 25,00 $ en sortie, et GPT-5.6 Sol 4,00 $ et 20,00 $. Même après la fin des tarifs promotionnels, le coût par token de 3.8 Flash resterait inférieur à celui des modèles phares d'OpenAI et d'Anthropic. Google explique que les gains de performance de 3.8 Flash proviennent en partie d'étapes de raisonnement supplémentaires et d'appels d'outils itératifs, ce qui augmente la consommation de tokens et peut atténuer l'avantage tarifaire par token. Pour des charges de travail où l'efficacité de calcul prime, Google recommande de réduire le niveau de raisonnement ou d'opter pour 3.7 Flash, toujours supporté.
Positionnement : cadence accélérée, benchmarks en hausse, 3D en démonstration
Trois semaines après 3.7 Flash, Google introduit Gemini 3.8 Flash en deux versions, généraliste et Cyber, dans une série de trois lancements Flash en six semaines, alors que Gemini 3.5 Pro et Gemini 4 ne sont pas disponibles. Koray Kavukcuoglu, responsable de DeepMind, indique que Google vise aussi l'excellence en capacité brute. Sur DeepSWE v1.1, Google annonce 73,7 % pour 3.8 Flash, proche de Claude Opus 5 (74,0 %), au-dessus de GPT-5.6 Sol (72,7 %) et en progrès sur 3.7 Flash (65,3 %), tandis que Claude Sonnet 5 est mesuré à 53,8 %. Selon Google, 3.8 Flash obtient de meilleurs résultats qu'Opus 5 et GPT-5.6 Sol sur de nombreux benchmarks, tout en étant nettement moins onéreux, tout en soulignant que les performances sur benchmarks ne reflètent pas toujours l'usage concret. Google met également en avant des progrès en génération 3D, illustrés par la création d'un jeu à partir d'un unique prompt dans Antigravity, avec des textures générées par le modèle d'image Nano Banana.
Accès développeurs, entreprises et grand public
Les développeurs peuvent utiliser Gemini 3.8 Flash via Google AI Studio, Google Antigravity et Android Studio. Les entreprises y accèdent à travers Gemini Enterprise. Pour les particuliers, le modèle est disponible dans l'application Gemini, en mode IA de Google Search, et dans Google Sheets pour les abonnés payants.




