
Google lance trois modèles dont Gemini 3.6 Flash : réduction de 17 % des coûts de tokens, vitesse doublée.
TechFlow SélectionTechFlow Sélection

Google lance trois modèles dont Gemini 3.6 Flash : réduction de 17 % des coûts de tokens, vitesse doublée.
Ces modèles sont conçus spécifiquement pour l'efficacité, la latence et la fiabilité nécessaires à la construction d'AI Agent à grande échelle.
Auteur : Google DeepMind
Traduction : TechFlow
Note TechFlow : Les trois modèles publiés cette fois par Google visent principalement à résoudre les véritables problèmes de la commercialisation des AI Agents : le coût et la vitesse. 3.6 Flash économise 17 % de tokens par rapport à la génération précédente, est moins cher mais de meilleure qualité ; 3.5 Flash-Lite atteint une vitesse de 350 tokens/seconde, c'est le modèle le plus rapide de la série 3.5 à ce jour ; et le modèle de cybersécurité dédié Flash Cyber vise le marché essentiel de la correction des vulnérabilités de code. Il ne s'agit pas d'un jeu de benchmarks de performance, mais de préparer le terrain pour le déploiement à grande échelle des AI Agents.
Google DeepMind publie aujourd'hui trois nouveaux modèles Gemini : 3.6 Flash, 3.5 Flash-Lite et 3.5 Flash Cyber. Ces modèles sont conçus pour l'efficacité, la latence et la fiabilité nécessaires à la construction d'AI Agents à grande échelle.
Gemini 3.6 Flash : Plus efficace, meilleure qualité
3.6 Flash est directement amélioré sur la base des retours des développeurs sur 3.5 Flash. Il non seulement va plus loin dans le codage et le travail de connaissance, mais améliore également considérablement l'efficacité des tokens. Selon l'Artificial Analysis Index, 3.6 Flash réduit la consommation de tokens de sortie de 17 % par rapport à 3.5 Flash. Dans certains benchmarks comme DeepSWE de Datacurve, la réduction atteint jusqu'à 65 %. Les étapes de raisonnement et les appels d'outils nécessaires pour compléter les workflows multi-étapes sont également réduits.
Cette amélioration de l'efficacité s'accompagne également d'un prix plus bas. Tarifié à 1,5 dollar par million de tokens d'entrée et 7,5 dollars par million de tokens de sortie, 3.6 Flash réduit le coût total de chaque tâche d'Agent, rendant la construction et l'exécution d'Agents plus économiques.
Même plus efficace, 3.6 Flash surpasse 3.5 Flash en performance dans divers cas d'usage :
Édition de code plus précise, réduisant les modifications et boucles d'exécution inutiles, atteignant 49 % sur DeepSWE (37 % pour 3.5 Flash), et améliorant significativement à 63,9 % sur le benchmark de recherche en machine learning MLE Bench (49,7 % pour 3.5 Flash)
Amélioration des capacités d'opération informatique, score OSWorld-Verified de 83,0 % (78,4 % pour 3.5 Flash). L'opération informatique est désormais disponible en tant qu'outil client intégré via Gemini API et Gemini Enterprise
Meilleure performance dans le travail de connaissance, comme un score de benchmark GDPval-AA v2 de 1421 (1349 pour 3.5 Flash). Des clients comme Hebbia et Harvey ont trouvé qu'il était particulièrement excellent dans les tâches multimodales telles que l'analyse de documents, les graphiques et l'analyse de données, la rédaction de rapports
Les clients indiquent que 3.6 Flash est une progression en termes de coût et de qualité, équilibrant l'efficacité des tokens, la précision et la vitesse dans les workflows complexes et les tâches de connaissance.
Conception de sécurité
3.6 Flash est équipé de mesures de sécurité de pointe renforcées, couvrant les domaines chimiques, biologiques, radiologiques et nucléaires (CBRN) ainsi que l'abus de cyberattaques. Ces protections augmentent considérablement la résistance du modèle aux attaques de jailbreak. De plus, le modèle est entraîné pour minimiser les refus d'usages bénéfiques.
Gemini 3.5 Flash-Lite : Conçu pour la mise à l'échelle des workflows d'Agent
3.5 Flash-Lite est conçu pour les tâches à faible latence et les scénarios de développement nécessitant un débit élevé, tels que la recherche d'Agent et le traitement de documents.
3.5 Flash-Lite est le modèle le plus rapide de la série 3.5. Selon Artificial Analysis, la vitesse d'exécution atteint 350 tokens de sortie par seconde. Tarifié à 0,3 dollar par million de tokens d'entrée et 2,5 dollars par million de tokens de sortie, et de qualité largement supérieure à 3.1 Flash-Lite, il offre un excellent rapport qualité-prix aux développeurs et clients exécutant des tâches de production à fort trafic.
3.5 Flash-Lite prend en charge la mise à l'échelle efficace des systèmes d'Agent. À tous les niveaux de réflexion, ce modèle surpasse significativement 3.1 Flash-Lite. Les développeurs peuvent configurer le modèle selon la charge de travail : utiliser des niveaux de réflexion minimaux et bas pour les tâches en grand volume, privilégiant une exécution à faible latence et à faible coût ; ou activer des niveaux de réflexion plus élevés pour traiter les charges de travail de sous-Agents multi-étapes. Le modèle intègre désormais également l'opération informatique en tant qu'outil intégré, prenant en charge de manière fiable les tâches d'Agent inter-interfaces.
Il présente des améliorations significatives dans les tâches de codage et d'Agent, comme un score de 54 % sur Terminal-Bench 2.1 (31 % pour 3.1 Flash-Lite), un contexte long comme GDM-MRCR v2 avec un score de 72,2 % (60,1 % pour 3.1 Flash-Lite), et l'exécution de tâches réelles comme GDPval-AA v2 avec un score de 1140 (642 pour 3.1 Flash-Lite).
En fait, dans de nombreuses évaluations d'Agent et de codage, 3.5 Flash-Lite dépasse même 3 Flash, y compris SWE-Bench Pro (54,2 % vs 49,6 %) et OSWorld-Verified (74,0 % vs 65,1 %), devenant un choix plus rapide et plus puissant pour les charges de travail 2.5 et 3 Flash.
Les premiers clients soulignent la combinaison unique de vitesse, d'intelligence et d'efficacité coût de 3.5 Flash-Lite dans l'extension des workflows d'Agent et les tâches de traitement de données.
Gemini 3.5 Flash Cyber dans CodeMender : Détection et correction efficaces des vulnérabilités
La vitesse à laquelle les modèles IA découvrent les vulnérabilités de sécurité a déjà dépassé la vitesse à laquelle les systèmes actuels les corrigent. Répondre à cette menace croissante nécessite une approche de sécurité logicielle à la fois efficace et puissante.
Les performances et l'efficacité de Flash en font une base idéale pour la détection, la validation et la correction à grande échelle des problèmes de sécurité de code. Gemini 3.5 Flash Cyber est construit sur 3.5 Flash, affiné spécifiquement pour découvrir et corriger les vulnérabilités de cybersécurité, et coûte moins cher par token que les grands modèles.
Dans CodeMender, plusieurs Agents 3.5 Flash Cyber travaillent ensemble pour générer un rapport complet unique, atteignant un niveau de compétitivité de pointe sur le benchmark populaire CyberGym.
Compte tenu de la nature à double usage de cette technologie, nous avons adopté une approche de déploiement prudente. Ce modèle sera bientôt disponible exclusivement pour les gouvernements et les partenaires de confiance via CodeMender sous la forme de projets pilotes à accès restreint. Cela permettra aux défenseurs de première ligne de découvrir et de corriger les vulnérabilités critiques avant qu'elles ne soient exploitées, tout en atténuant les risques d'abus plus larges.
Commencez à utiliser dès maintenant
3.6 Flash et 3.5 Flash-Lite sont disponibles dès aujourd'hui :
Les développeurs peuvent l'utiliser via Gemini API dans Google AI Studio et Android Studio. 3.6 Flash est également disponible dans Google Antigravity
Les entreprises peuvent l'utiliser dans la plateforme Gemini Enterprise Agent. 3.6 Flash est également disponible dans l'application Gemini Enterprise
Tout le monde peut l'utiliser via l'application Gemini. 3.5 Flash-Lite est également en cours de déploiement dans Recherche Google
Les retours sont les bienvenus pour améliorer les futurs modèles Gemini, nous attendons avec impatience la publication prochaine de 3.5 Pro.
Bienvenue dans la communauté officielle TechFlow
Groupe Telegram :https://t.me/TechFlowDaily
Compte Twitter officiel :https://x.com/TechFlowPost
Compte Twitter anglais :https://x.com/BlockFlow_News














