⚡ Grok 4.6, Gemini 3.7 Flash, GLM-5.3 : la semaine où six modèles sont sortis

En quatre jours à la mi-août 2026, xAI, Google et Z.ai ont chacun sorti un nouveau modèle frontière. Comparatif prix-performance de Grok 4.6, Gemini 3.7 Flash et GLM-5.3.

Date : 2026-08-18

Tags : xAI, Google, LLM, IA Générative, Productivité

![Illustration officielle de Gemini 3.7 Flash, présenté par Google comme son modèle le plus intelligent pour le code et les agents](https://storage.googleapis.com/gweb-uniblog-publish-prod/images/gemini-3-7-flash.width-1300.png) Entre le 12 et le 17 août 2026, quatre laboratoires ont sorti un nouveau modèle frontière en l'espace de quelques jours à peine : xAI avec Grok 4.6, Google avec Gemini 3.7 Flash, DeepSeek avec V4-Pro-0813 (déjà traité en détail sur ce blog), et Z.ai avec GLM-5.3. Cette cadence de sortie, presque un modèle par jour, illustre une bascule stratégique commune : tous ces modèles ciblent en priorité les agents qui restent concentrés sur une tâche longue, plutôt que la simple conversation. ## Grok 4.6 : l'intelligence brute, au prix fort Sorti le 12 août 2026, Grok 4.6 est un raffinement post-entraînement de Grok 4.5, taillé pour les agents longue durée capables de vérifier eux-mêmes l'achèvement de leurs sous-tâches. Sur l'Intelligence Index d'Artificial Analysis, il obtient un score de 61, la valeur la plus élevée du lot cette semaine-là, devant les premières lectures de Gemini 3.7 Flash à 56. Mais ce score s'accompagne d'un tarif nettement plus élevé que ses concurrents : 2 dollars par million de tokens en entrée et 6 dollars en sortie, un tarif qui double au-delà de 200 000 tokens d'entrée. Sur les benchmarks de code que les équipes d'ingénierie surveillent de près, Grok 4.6 reste en retrait : 65,9% sur DeepSWE v1.1 contre 73% pour GPT-5.6 Sol Max, et seulement 26% sur Terminal-Bench v3.0, la dernière place parmi les modèles frontières listés malgré un score presque doublé par rapport à son prédécesseur. ## Gemini 3.7 Flash : la réponse prix de Google, trois semaines après 3.6 Flash Le 13 août 2026, soit un jour après Grok 4.6, Google a publié Gemini 3.7 Flash avec une stratégie inverse : un tarif divisé par deux par rapport à Gemini 3.6 Flash, sorti seulement trois semaines plus tôt. Le prix introductif s'élève à 0,75 dollar par million de tokens en entrée et 3,75 dollars en sortie jusqu'au 31 décembre 2026, avant de doubler au 1er janvier 2027. Sur les benchmarks propres à Google, le modèle progresse nettement par rapport à 3.6 Flash : de 34,4% à 43,6% sur FrontierCode 1.1, et de 49% à 65,3% sur DeepSWE v1.1. Sur AutomationBench, qui mesure la capacité à compléter des flux de travail métier réels, le score passe de 17% à 30,4%. | Modèle | Date de sortie | Prix entrée / sortie (par M tokens) | Intelligence Index (AA) | |---|---|---|---| | Grok 4.6 (xAI) | 12/08/2026 | 2 $ / 6 $ | 61 | | Gemini 3.7 Flash (Google, tarif intro jusqu'au 31/12/2026) | 13/08/2026 | 0,75 $ / 3,75 $ | ~56 | | DeepSeek V4-Pro-0813 (tarif intro) | 13/08/2026 | 0,435 $ / 0,87 $ | 53 | | GLM-5.3 (Z.ai, tarif API) | 14/08/2026 | 1,40 $ / 4,40 $ | non communiqué | ![Graphique officiel de Google comparant le rapport performance-prix de Gemini 3.7 Flash face aux modèles concurrents](https://storage.googleapis.com/gweb-uniblog-publish-prod/images/gemini-3-7-flash__evals__perform.width-1200.format-webp.webp) ## GLM-5.3 : la cybersécurité comme argument de vente, les poids encore verrouillés Le 14 août 2026, Z.ai a annoncé GLM-5.3, présenté comme reposant sur la même base que GLM-5.2 mais entièrement amélioré par post-entraînement renforcé. La particularité de cette sortie tient à deux éléments. D'abord, la cybersécurité : Z.ai revendique un score de 84,5% sur CyberGym, devant Claude Fable 5 (83,8%) et GPT-5.6 Sol (83,6%), et le modèle aurait découvert une vulnérabilité jusque-là inconnue dans Cursor peu après son lancement. Ensuite, contrairement aux sorties précédentes de Z.ai généralement accompagnées d'une publication immédiate des poids, ceux de GLM-5.3 restent verrouillés le temps d'une revue de sécurité, avec une disponibilité annoncée pour fin août 2026. Le modèle est accessible dès maintenant via l'API Z.ai à 1,40 dollar par million de tokens en entrée et 4,40 dollars en sortie, soit un coût total de 5,80 dollars pour un million de tokens de chaque type, contre 8 dollars pour Grok 4.6, 18 dollars pour Kimi K3, 30 dollars pour Claude Opus 5 et 35 dollars pour GPT-5.6 Sol sur cette même base de comparaison. > « Le marché des modèles actuel divise le problème des agents selon des priorités différentes. » > — Analyse Kylon.io, août 2026 ## Ce que cette cadence change concrètement pour une petite structure Cette accélération simultanée sur quatre fronts, intelligence brute pour Grok, prix agressif pour Gemini, cybersécurité pour GLM, dispo générale pour DeepSeek, complique le choix d'un modèle unique pour toute organisation qui automatise ses tâches. Un benchmark indépendant, Baba Is Bench, souligne d'ailleurs qu'il ne faut pas se fier aux petites variations de numéro de version : les résultats qualitatifs entre ces modèles peuvent différer fortement d'une version à l'autre, y compris sur des tâches simples. Pour une TPE ou un indépendant, la meilleure approche n'est plus de choisir un modèle une fois pour toutes, mais de construire ses automatisations de façon suffisamment modulaire pour pouvoir basculer d'un fournisseur à l'autre selon le rapport coût-performance du moment, une compétence que travaille justement la formation [Optimiser et automatiser son quotidien professionnel grâce au no-code et à l'IA](https://www.travelearn.fr/formation/optimiser-et-automatiser-son-quotidien-professionnel), pensée pour des outils simples et accessibles plutôt que pour un fournisseur unique. --- **Sources** - [Introducing Gemini 3.7 Flash - Google](https://blog.google/innovation-and-ai/models-and-research/gemini-models/introducing-gemini-3-7-flash/) - [Gemini 3.7 Flash vs Grok 4.6: Price War vs Agent Track Record - Orca Router](https://www.orcarouter.ai/blog/gemini-3-7-flash-vs-grok-4-6) - [GLM-5.3 hits the API at $1.4/$4.4 per million tokens - VentureBeat](https://venturebeat.com/technology/glm-5-3-hits-the-api-at-1-4-4-4-per-million-tokens)