Tu veux les meilleurs outils IA avant les autres ?
On teste et on décrypte les nouveaux outils IA chaque soir, en 5 min. Gratuit.
Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.
Choisis ton rythme
Gratuit · Pas de spam · Désabonnement en 1 clic
Google présente ses nouveaux modèles Gemini Flash
Google continue d'élargir sa gamme de modèles d'intelligence artificielle sous la bannière Gemini. Dans une annonce faite le 21 juillet 2026, la société a révélé trois nouveaux modèles conçus pour optimiser l'exécution d'agents IA à grande échelle. Les modèles Gemini 3.6 Flash, 3.5 Flash-Lite et 3.5 Flash Cyber visent tous à offrir une plus grande efficacité, une latence réduite et des coûts moindres.
Une série orientée vers l'efficacité et la réduction des coûts
La série Flash de Gemini est conçue pour équilibrer qualité et efficacité dans le traitement des workflows agentiques. Les trois nouveaux modèles s'inscrivent dans cette stratégie :
-
Gemini 3.6 Flash est considéré comme le modèle principal de la série, offrant des performances améliorées dans le développement, la gestion des connaissances et les applications multimodales. Selon l'Artificial Analysis Index, il réduit la consommation de tokens de sortie de 17 % par rapport à 3.5 Flash, avec des améliorations allant jusqu'à 65 % sur certains benchmarks tels que DeepSWE.
-
Gemini 3.5 Flash-Lite est le modèle le plus rapide et le plus économique de la série 3.5. Il est capable de générer 350 tokens par seconde, ce qui le rend idéal pour les tâches à fort volume comme la recherche agentique et le traitement de documents.
-
Gemini 3.5 Flash Cyber est un modèle spécialisé, conçu pour identifier et corriger les vulnérabilités de sécurité. Il est intégré dans CodeMender, l'agent de sécurité de Google.
Les deux premiers modèles, Gemini 3.6 Flash et 3.5 Flash-Lite, sont désormais disponibles pour les développeurs via l'API Gemini, pour les entreprises via Gemini Enterprise, et pour le grand public dans l'application Gemini. Le modèle Cyber, en raison de son potentiel à double usage, est réservé aux gouvernements et partenaires de confiance dans le cadre d'un programme pilote à accès restreint.
Tarification des nouveaux modèles Flash
Pour un million de tokens, les tarifs sont les suivants :
-
Gemini 3.6 Flash : 1,50 $ pour l'entrée et 7,50 $ pour la sortie.
-
Gemini 3.5 Flash-Lite : 0,30 $ pour l'entrée et 2,50 $ pour la sortie.
Google souligne que le modèle 3.6 Flash est proposé à un tarif inférieur à celui de son prédécesseur, le 3.5 Flash.
L'absence remarquée de Gemini 3.5 Pro
Bien que ces nouveaux modèles soient variés, l'absence d'une version axée sur la performance est notable. Google n'a pas encore mis à jour son modèle haut de gamme, Gemini Pro, dont la dernière version date de février 2026. Lors du lancement de Gemini 3.5 Flash en mai dernier, Google avait pourtant annoncé l'arrivée imminente d'un 3.5 Pro.
Dans son communiqué, Google précise que 3.5 Pro est actuellement en phase de test auprès de partenaires et sera déployé « dès qu'il sera prêt ». Selon Bloomberg, l'entreprise rencontre des retards internes, le modèle peinant à atteindre ses objectifs de performance, notamment en matière de codage. Parallèlement, les équipes ont lancé le cycle de pré-entraînement le plus ambitieux à ce jour pour Gemini 4.
Ce calendrier s'inscrit dans un contexte de forte concurrence. Depuis février, OpenAI a lancé GPT-5.5 puis GPT-5.6, tandis qu'Anthropic a introduit Claude Opus 4.8, Sonnet 5 et élargi l'accès à son modèle Fable 5.


