⚡ Gemini 3.6 Flash : Google accélère et vise Gemini 4

Google lance Gemini 3.6 Flash (-17% tokens, 1,50 $/M), 3.5 Flash-Lite (350 t/s, 0,30 $/M) et Flash Cyber. Gemini 4 en pretraining depuis juillet 2026.

Date : 2026-07-24

Tags : Google, Gemini, LLM, IA Générative, Agent IA

![Gemini 3.6 Flash, 3.5 Flash-Lite et 3.5 Flash Cyber — l'annonce officielle Google](https://9to5google.com/wp-content/uploads/sites/4/2026/07/Gemini-3.6-cover.jpg?quality=82&strip=all&w=1600) Google a frappé fort le 21 juillet 2026 en lançant simultanément trois nouveaux modèles Gemini. Pendant que l'industrie attendait le très annoncé Gemini 3.5 Pro, Mountain View a surpris tout le monde avec une gamme Flash repensée, plus efficace, moins coûteuse, et orientée agents IA, tout en glissant discrètement une annonce qui change tout : le pretraining de Gemini 4 a commencé. ## Que sont ces trois nouveaux modèles Gemini ? La stratégie de Google avec la gamme Flash est claire : offrir des modèles rapides et abordables pour les usages à fort volume, là où les modèles "Pro" sont réservés aux tâches les plus complexes. Ce triple lancement couvre trois besoins distincts, ce qui explique pourquoi Google a choisi de les sortir simultanément plutôt que séquentiellement. Gemini 3.6 Flash est la mise à jour principale : conçu pour être plus efficace à chaque échange, il génère 17 % de tokens en moins qu'auparavant pour un résultat de qualité égale ou supérieure, ce qui réduit mécaniquement les coûts d'utilisation pour les développeurs. Gemini 3.5 Flash-Lite est positionné comme le modèle le plus rapide de la gamme, atteignant 350 tokens par seconde, un chiffre qui en fait l'un des LLM commerciaux les plus véloces disponibles aujourd'hui. Gemini 3.5 Flash Cyber, enfin, est un modèle spécialisé en cybersécurité, entraîné spécifiquement pour détecter et corriger des vulnérabilités dans le code, avec un accès restreint aux gouvernements et partenaires certifiés dans un premier temps. Cette segmentation fine illustre la stratégie de Google : ne pas vendre "un modèle", mais une infrastructure intelligente adaptée à chaque cas d'usage professionnel. ## Quelles sont les performances et les tarifs de Gemini 3.6 Flash ? Les benchmarks publiés par Google confirment une amélioration significative par rapport à la version précédente, notamment sur les tâches longues et les usages agentiques. Sur DeepSWE, le standard pour les agents de développement logiciel, Gemini 3.6 Flash atteint 49 % contre 37 % pour son prédécesseur, soit une progression de 12 points. Sur MLE-Bench, il monte à 63,9 % contre 49,7 %. Sur OSWorld-Verified, qui mesure la capacité d'un modèle à accomplir des tâches sur un ordinateur comme le ferait un humain, il atteint 83 % contre 78,4 %. La tarification, elle, est délibérément agressive dans un contexte de guerre des prix entre les grands labs IA. | Modèle | Input (1M tokens) | Output (1M tokens) | Vitesse | Contexte | |---|---|---|---|---| | Gemini 3.6 Flash | 1,50 $ | 7,50 $ | Rapide | 1M tokens | | Gemini 3.5 Flash-Lite | 0,30 $ | 2,50 $ | 350 tokens/s | 1M tokens | | Gemini 3.5 Flash (ancien) | ~1,80 $ | ~9,00 $ | Rapide | 1M tokens | | Gemini 3.5 Flash Cyber | Restreint | Restreint | — | — | Pour les entreprises qui font tourner des agents IA sur des tâches longues et complexes, l'impact est concret : jusqu'à 65 % d'économies sur les workflows d'ingénierie longue durée, selon les benchmarks Google. Des entreprises comme Figma, JetBrains, Harvey et Hebbia ont intégré Gemini 3.6 Flash dès son lancement et témoignent d'améliorations sensibles sur leurs pipelines de traitement documentaire et d'analyse de données. ![Benchmarks comparatifs de Gemini 3.6 Flash sur les tâches agentiques](https://storage.googleapis.com/gweb-uniblog-publish-prod/images/gemini-3-6-flash__evals__figure-.width-1200.format-webp.webp) ## Pourquoi Gemini 3.5 Pro est encore absent, et ce que ça révèle de la stratégie Google ? C'est l'éléphant dans la pièce de cette annonce. Gemini 3.5 Pro était attendu depuis plusieurs mois, régulièrement reporté, et son absence lors de ce triple lancement commence à poser des questions légitimes dans la communauté des développeurs. Google n'a pas fourni de date officielle de disponibilité générale pour le Pro, se contentant d'indiquer qu'il est "en cours de finalisation." Cette stratégie de lancement, saturer le marché avec des modèles Flash performants et bon marché pendant que le modèle phare reste en retrait, permet à Google de capter les usages à fort volume là où les revenus s'accumulent, tout en gardant le Pro comme carte maîtresse. La véritable surprise enfouie dans cette annonce, c'est le signal envoyé sur Gemini 4 : Google DeepMind a officiellement indiqué avoir débuté "l'opération de pretraining la plus ambitieuse jamais entreprise." Cela change la perspective pour les équipes qui évaluent Gemini aujourd'hui : le Pro 3.5 devient une étape transitoire, et Gemini 4 se profile comme la prochaine rupture technologique majeure. > "La combinaison unique de vitesse, d'intelligence et d'efficacité de coût de Gemini Flash est exactement ce dont nous avions besoin pour passer à l'échelle nos workflows agentiques." > > *Ashler, client early access Gemini 3.5 Flash-Lite* ## Quel impact concret pour les professionnels qui utilisent l'IA au travail ? Pour un utilisateur qui exploite les outils IA dans son travail quotidien, ce lancement a plusieurs implications pratiques immédiates. La première, c'est que les interfaces Google alimentées par Gemini, notamment Google AI Studio, Gemini dans Workspace, ou les intégrations tierces, vont progressivement bénéficier de réponses plus concises et plus précises grâce à la compression naturelle des tokens de 3.6 Flash. La deuxième implication, c'est que la baisse des coûts rend enfin viables des automatisations qui étaient autrefois trop chères à faire tourner en continu : des agents de veille, des workflows de traitement documentaire, ou des assistants spécialisés peuvent désormais fonctionner 24h/24 pour un budget mensuel raisonnable. La troisième implication concerne Flash-Lite : à 350 tokens par seconde et 0,30 $ pour un million de tokens en entrée, ce modèle est taillé pour les applications à très fort volume, comme les chatbots de service client ou les interfaces de génération de contenu à grande échelle. Pour les professionnels qui souhaitent construire leurs propres workflows automatisés avec des modèles comme Gemini Flash, que ce soit pour gagner du temps sur des tâches répétitives ou déployer de véritables agents IA dans leur activité, la formation [Automatiser ses workflows et créer des agents IA](https://www.travelearn.fr/formation/automatiser-ses-workflows-et-crer-des-agents-ia) donne toutes les clés pour passer de la théorie à la pratique, sans compétences techniques préalables. --- **Sources** - [Introducing Gemini 3.6 Flash, 3.5 Flash-Lite, and 3.5 Flash Cyber — Google Blog](https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-6-flash-3-5-flash-lite-3-5-flash-cyber/) - [Google releases three new Gemini models — but no 3.5 Pro — TechCrunch](https://techcrunch.com/2026/07/21/google-releases-three-new-gemini-models-but-no-3-5-pro/) - [Gemini 3.6 Flash cuts AI agent token costs by up to 65% — VentureBeat](https://venturebeat.com/technology/googles-gemini-3-6-flash-model-cuts-ai-agent-token-costs-by-up-to-65-on-long-horizon-engineering-tasks-and-3-5-pro-is-on-the-way)