Google a officialisé, ce 21 juillet 2026, le lancement de trois nouveaux modèles d’intelligence artificielle : Gemini 3.6 Flash, Gemini 3.5 Flash-Lite et Gemini 3.5 Flash Cyber. Cette triple annonce mise sur l’efficacité, la rapidité et la baisse des coûts, plutôt que sur la seule puissance brute. Parallèlement, Google confirme avoir lancé le pré-entraînement de Gemini 4, sa prochaine génération de modèles.
Le très attendu Gemini 3.5 Pro reste, lui, réservé à un cercle restreint de partenaires. Cette nouvelle gamme s’adresse donc en priorité aux entreprises qui cherchent à automatiser des tâches à grand volume, sans voir leur facture cloud exploser.
Un virage stratégique vers les agents autonomes à bas coût
En réduisant fortement le coût par jeton, et en limitant le nombre d’appels d’outils nécessaires pour accomplir une tâche complexe, Google veut démocratiser l’usage des agents autonomes en entreprise. Cette rationalisation financière permet de déployer des architectures d’IA à grande échelle, sans faire exploser les dépenses d’infrastructure.
Gemini 3.6 Flash : le nouveau modèle généraliste
Gemini 3.6 Flash remplace directement le modèle 3.5 Flash. Il devient le nouveau modèle de travail par défaut de la gamme Google, pensé pour réduire le gaspillage de jetons et fluidifier les tâches agentiques en plusieurs étapes.
Plusieurs progrès techniques ressortent de cette mise à jour :
- Moins de jetons consommés : selon l’index Artificial Analysis, le modèle utilise 17 % de jetons de sortie en moins qu’auparavant, à tâche équivalente.
- Un tarif en baisse : le prix passe à 7,50 $ par million de tokens en sortie, contre 9 $ précédemment.
- De meilleurs résultats en programmation : le score sur le benchmark DeepSWE grimpe de 37 % à 49 %, et celui sur MLE Bench passe de 49,7 % à 63,9 %.
- Un meilleur contrôle des interfaces informatiques (Computer Use) : le modèle atteint 83 % sur le benchmark OSWorld-Verified.
- Des connaissances plus récentes : la date de coupure des données d’entraînement passe de janvier 2025 à mars 2026.
- Une fenêtre de contexte inchangée, toujours fixée à 1 million de tokens en entrée.
We’re rolling out three new models to make AI agents faster, smarter, and cheaper at scale:
— Google DeepMind (@GoogleDeepMind) July 21, 2026
🔵 Gemini 3.6 Flash: It uses fewer tokens than 3.5 Flash to deliver higher quality work at the exact same cost.
🔵 Gemini 3.5 Flash-Lite: A fast, cost-effective option for everyday tasks… pic.twitter.com/SP1eU3FCW5
Flash-Lite et Flash Cyber : deux modèles très spécialisés
En complément de Gemini 3.6 Flash, Google introduit deux déclinaisons pensées pour des besoins précis.
Gemini 3.5 Flash-Lite cible la recherche automatisée à fort débit, le traitement de documents en masse et la gestion de flux de données volumineux. Son tarif d’entrée, fixé à seulement 0,30 $ par million de tokens, en fait le modèle le moins cher de la gamme. Selon Google, ce modèle d’entrée de gamme dépasse même les performances du précédent modèle Flash standard sur le test de programmation SWE-Bench Pro, avec un score de 54,2 % contre 49,6 %.

Gemini 3.5 Flash Cyber, de son côté, a été spécifiquement entraîné pour détecter et corriger automatiquement des failles logicielles. Il alimente la plateforme CodeMender. En raison des risques de cybersécurité liés à ce type d’outil, ce modèle n’est pas disponible au grand public. Il reste réservé, pour l’instant, aux gouvernements et à un nombre restreint de partenaires stratégiques, dans le cadre d’un programme pilote.
Tarifs et disponibilité en un coup d’œil
| Modèle | Tarif entrée / sortie (par million de tokens) | Spécificité principale | Disponibilité |
| Gemini 3.6 Flash | ~1,50 $ / 7,50 $ | Polyvalence, -17 % de jetons, gros progrès en code | App Gemini, AI Studio, Antigravity, Android Studio |
| Gemini 3.5 Flash-Lite | 0,30 $ / ~2,50 $ | Volume et débit, recherche agentique à grande échelle | App Gemini, AI Studio, Android Studio, Recherche Google |
| Gemini 3.5 Flash Cyber | Non communiqué | Détection et correction automatisée de failles | Programme pilote (gouvernements et partenaires) |
Gemini 3.6 Flash et Flash-Lite sont, eux, immédiatement accessibles aux développeurs comme au grand public, via l’application Gemini, Google AI Studio, Antigravity ou Android Studio.
Gemini 4 déjà en préparation
Cette annonce s’accompagne d’un signal envoyé à la concurrence. Google a confirmé le lancement officiel du pré-entraînement de Gemini 4. Ses équipes d’ingénierie le décrivent comme le run d’entraînement le plus ambitieux mené par l’entreprise à ce jour.
Ce calendrier s’inscrit dans un contexte réglementaire tendu en Europe, où l’ouverture forcée d’Android aux assistants IA concurrents pousse Google à maintenir une avance technologique constante, pour préserver sa position dominante sur le marché mobile.
- Partager l'article :
Restez à la pointe de l'information avec
INTELLIGENCE-ARTIFICIELLE.COM !

