Gemini 3.6 et 3.5 : Révolution de l'efficacité IA avec Flash et Cyber

Le brief IA que les pros lisent chaque soir
Les 7 actus IA du jour, décryptées en 5 min. Gratuit.
Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.
Choisis ton rythme
Gratuit · Pas de spam · Désabonnement en 1 clic
Une nouvelle ère pour les modèles Gemini
Les derniers modèles de la série Gemini, à savoir Gemini 3.6 Flash, 3.5 Flash-Lite et 3.5 Flash Cyber, sont conçus pour répondre aux besoins croissants en efficacité, latence et fiabilité des agents d'intelligence artificielle à grande échelle. Pour les développeurs et les clients qui s'appuient sur ces agents en production, l'amélioration de l'efficacité des tokens, la réduction de la latence et une performance fiable sont des impératifs. La série Flash de Gemini vise à offrir un équilibre optimal entre efficacité et qualité, permettant ainsi une évolution fluide des flux de travail agentiques.
Les nouveaux modèles en détail
-
3.6 Flash : Ce modèle phare se distingue par ses performances supérieures en codage, travail de connaissance et capacités multimodales. Selon l'Artificial Analysis Index, il parvient à réduire l'utilisation des tokens de sortie de 17 % par rapport à son prédécesseur, le 3.5 Flash. Dans certains benchmarks, comme le DeepSWE de Datacurve, cette réduction atteint jusqu'à 65 %, tout en maintenant un coût par token de sortie plus bas.
-
3.5 Flash-Lite : Ce modèle est le plus rapide et le plus économique de la série 3.5, capable de produire 350 tokens de sortie par seconde, d'après l'Artificial Analysis Index. Il surpasse les versions précédentes de Flash-Lite dans les flux de travail agentiques, offrant ainsi une solution rapide et rentable.
-
3.5 Flash Cyber : Intégré dans CodeMender, ce modèle se concentre sur la cybersécurité. Il associe un modèle spécialisé avec une infrastructure d'agents pour offrir des performances de pointe dans la détection et la correction des vulnérabilités de sécurité du code.
Performances et innovations de Gemini 3.6 Flash
Gemini 3.6 Flash a été développé en réponse aux retours des utilisateurs de 3.5 Flash, avec des améliorations notables en codage et travail de connaissance, ainsi qu'une efficacité accrue des tokens. Sur l'Artificial Analysis Index, il consomme 17 % de tokens de sortie en moins que le modèle précédent. De plus, il nécessite moins d'étapes de raisonnement et d'appels d'outils pour accomplir des tâches complexes.
Cette efficacité se traduit par un coût réduit, avec un prix de 1,50 $ pour un million de tokens d'entrée et 7,50 $ pour un million de tokens de sortie, rendant la création et l'exécution d'agents plus abordables.
Améliorations de performance
Gemini 3.6 Flash surpasse son prédécesseur dans plusieurs domaines d'application :
-
Précision accrue : Moins de modifications de code indésirables et des boucles d'exécution réduites, comme le montre le benchmark DeepSWE (49 % contre 37 %).
-
Recherche ML améliorée : Des résultats significatifs dans MLE Bench (63,9 % contre 49,7 %).
-
Capacités d'utilisation informatique : Améliorations démontrées par OSWorld-Verified (83,0 % contre 78,4 %).
Dans le domaine du travail de connaissance, 3.6 Flash excelle, comme l'indiquent les benchmarks tels que GDPval-AA v2 (1421 contre 1349). Des clients comme Hebbia et Harvey ont constaté ses performances exceptionnelles dans l'analyse de documents, graphiques et données, ainsi que dans la rédaction de rapports.
3.5 Flash-Lite : Optimisation des flux de travail
Gemini 3.5 Flash-Lite est conçu pour des tâches nécessitant une faible latence et un haut débit, essentielles pour les développeurs dans des domaines tels que la recherche agentique et le traitement de documents. Ce modèle, le plus rapide de la série 3.5, atteint une vitesse de 350 tokens de sortie par seconde. Avec un coût de 0,30 $ pour un million de tokens d'entrée et 2,50 $ pour un million de tokens de sortie, il offre un excellent rapport qualité-prix pour les environnements de production à haut débit.
3.5 Flash Cyber : Sécurité renforcée
Les modèles d'IA, comme Gemini 3.5 Flash Cyber, sont désormais capables de détecter les vulnérabilités de sécurité plus rapidement que les systèmes actuels ne peuvent les corriger. Grâce à sa performance et son efficacité, Flash est idéal pour détecter, valider et corriger les problèmes de sécurité du code à grande échelle.
Gemini 3.5 Flash Cyber, basé sur 3.5 Flash, est optimisé pour la cybersécurité, offrant un coût par token inférieur à celui des modèles plus volumineux. Dans CodeMender, qui utilise plusieurs agents 3.5 Flash Cyber pour produire un rapport combiné, ce modèle atteint des performances compétitives sur le benchmark CyberGym.
Disponibilité des nouveaux modèles
Les modèles 3.6 Flash et 3.5 Flash-Lite sont désormais disponibles :
-
Pour les développeurs, via l'API Gemini dans Google AI Studio et Android Studio. 3.6 Flash est également accessible dans Google Antigravity.
-
Pour les entreprises, sur la plateforme d'agents Gemini Enterprise. 3.6 Flash est aussi disponible dans l'application Gemini Enterprise.
-
Pour le grand public, via l'application Gemini. 3.5 Flash-Lite est également déployé dans Google Search.
Nous encourageons les utilisateurs à partager leurs retours pour améliorer les futurs modèles Gemini et nous préparons le lancement de 3.5 Pro prochainement.
Brief IA — L'actualité IA en français
L'essentiel de l'actualité de l'intelligence artificielle, décrypté et expliqué chaque jour.