3.6 Flash, Flash-Lite et Flash Cyber, les trois nouveaux modèles Gemini à petit prix

Google a officialisé, ce 21 juillet 2026, le lancement de trois nouveaux modèles d’intelligence artificielle : Gemini 3.6 Flash, Gemini 3.5 Flash-Lite et Gemini 3.5 Flash Cyber. Cette triple annonce mise sur l’efficacité, la rapidité et la baisse des coûts, plutôt que sur la seule puissance brute. Parallèlement, Google confirme avoir lancé le pré-entraînement de Gemini 4, sa prochaine génération de modèles.

Le très attendu Gemini 3.5 Pro reste, lui, réservé à un cercle restreint de partenaires. Cette nouvelle gamme s’adresse donc en priorité aux entreprises qui cherchent à automatiser des tâches à grand volume, sans voir leur facture cloud exploser.

Un virage stratégique vers les agents autonomes à bas coût

En réduisant fortement le coût par jeton, et en limitant le nombre d’appels d’outils nécessaires pour accomplir une tâche complexe, Google veut démocratiser l’usage des agents autonomes en entreprise. Cette rationalisation financière permet de déployer des architectures d’IA à grande échelle, sans faire exploser les dépenses d’infrastructure.

Youtube video

Gemini 3.6 Flash : le nouveau modèle généraliste

Gemini 3.6 Flash remplace directement le modèle 3.5 Flash. Il devient le nouveau modèle de travail par défaut de la gamme Google, pensé pour réduire le gaspillage de jetons et fluidifier les tâches agentiques en plusieurs étapes.

Plusieurs progrès techniques ressortent de cette mise à jour :

  • Moins de jetons consommés : selon l’index Artificial Analysis, le modèle utilise 17 % de jetons de sortie en moins qu’auparavant, à tâche équivalente.
  • Un tarif en baisse : le prix passe à 7,50 $ par million de tokens en sortie, contre 9 $ précédemment.
  • De meilleurs résultats en programmation : le score sur le benchmark DeepSWE grimpe de 37 % à 49 %, et celui sur MLE Bench passe de 49,7 % à 63,9 %.
  • Un meilleur contrôle des interfaces informatiques (Computer Use) : le modèle atteint 83 % sur le benchmark OSWorld-Verified.
  • Des connaissances plus récentes : la date de coupure des données d’entraînement passe de janvier 2025 à mars 2026.
  • Une fenêtre de contexte inchangée, toujours fixée à 1 million de tokens en entrée.

Flash-Lite et Flash Cyber : deux modèles très spécialisés

En complément de Gemini 3.6 Flash, Google introduit deux déclinaisons pensées pour des besoins précis.

Gemini 3.5 Flash-Lite cible la recherche automatisée à fort débit, le traitement de documents en masse et la gestion de flux de données volumineux. Son tarif d’entrée, fixé à seulement 0,30 $ par million de tokens, en fait le modèle le moins cher de la gamme. Selon Google, ce modèle d’entrée de gamme dépasse même les performances du précédent modèle Flash standard sur le test de programmation SWE-Bench Pro, avec un score de 54,2 % contre 49,6 %.

Benchmarks Gemini 3.6 FLash
©blog.google/

Gemini 3.5 Flash Cyber, de son côté, a été spécifiquement entraîné pour détecter et corriger automatiquement des failles logicielles. Il alimente la plateforme CodeMender. En raison des risques de cybersécurité liés à ce type d’outil, ce modèle n’est pas disponible au grand public. Il reste réservé, pour l’instant, aux gouvernements et à un nombre restreint de partenaires stratégiques, dans le cadre d’un programme pilote.

Tarifs et disponibilité en un coup d’œil

ModèleTarif entrée / sortie (par million de tokens)Spécificité principaleDisponibilité
Gemini 3.6 Flash~1,50 $ / 7,50 $Polyvalence, -17 % de jetons, gros progrès en codeApp Gemini, AI Studio, Antigravity, Android Studio
Gemini 3.5 Flash-Lite0,30 $ / ~2,50 $Volume et débit, recherche agentique à grande échelleApp Gemini, AI Studio, Android Studio, Recherche Google
Gemini 3.5 Flash CyberNon communiquéDétection et correction automatisée de faillesProgramme pilote (gouvernements et partenaires)

Gemini 3.6 Flash et Flash-Lite sont, eux, immédiatement accessibles aux développeurs comme au grand public, via l’application Gemini, Google AI Studio, Antigravity ou Android Studio.

Gemini 4 déjà en préparation

Cette annonce s’accompagne d’un signal envoyé à la concurrence. Google a confirmé le lancement officiel du pré-entraînement de Gemini 4. Ses équipes d’ingénierie le décrivent comme le run d’entraînement le plus ambitieux mené par l’entreprise à ce jour.

Ce calendrier s’inscrit dans un contexte réglementaire tendu en Europe, où l’ouverture forcée d’Android aux assistants IA concurrents pousse Google à maintenir une avance technologique constante, pour préserver sa position dominante sur le marché mobile.

Restez à la pointe de l'information avec
INTELLIGENCE-ARTIFICIELLE.COM !

Abonnez-vous à notre chaîne YouTube et rejoignez-nous sur Actualités

ARTICLES SIMILAIRES

IA Robotique : NVIDIA déploie Cosmos 3 Edge en open source

Durant le SIGGRAPH 2026, la firme lance Cosmos 3 Edge NVIDIA. Ce modèle open source stimule la robotique de demain. Il équipe les matériels Edge.

21 juillet 2026

GPT-5.6 vs Grok 4.5 : que vaut vraiment l’IA à 2 dollars face au géant d’OpenAI ?

À peine vingt-quatre heures séparent la sortie de Grok 4.5 de celle de GPT-5.6. Ce tir croisé opéré au début du mois de juillet 2026

21 juillet 2026

Comment exploiter pleinement GPT-5.6 dans Codex pour un code performant ?

Quelques jours seulement après la sortie officielle du tout dernier modèle phare d’OpenAI, GPT-5.6, les développeurs disposent d’un recul suffisant pour évaluer son impact réel

21 juillet 2026

GPT-5.5 vs Gemini : le duel des IA de 2026

GPT-5.5 (OpenAI) et Gemini 3.0 Pro (Google DeepMind) sont deux modèles de langage (LLM) multimodaux de pointe en 2026. Gemini 3.0 Pro se distingue par

20 juillet 2026

GPT-5.5 vs Claude : quel modèle choisir en 2026 ?

GPT-5.5 (OpenAI) et Claude (Anthropic, génération 4.6) sont les deux modèles de langage (LLM) de référence du marché en 2026. GPT-5.5 se distingue par ses

19 juillet 2026

Meta lance un détecteur d’images IA, mais un simple recadrage suffit à le piéger

Meta lance un détecteur d’images IA, mais un simple recadrage suffit à le piéger

Avec la sortie de Grok 4.5, Meta dévoile un outil censé repérer ses images générées par intelligence artificielle. Problème : il ne marche plus dès

14 juillet 2026