Google ajoute Gemini 3.7 Flash à sa gamme d’intelligence artificielle, quelques semaines seulement après le lancement de la version 3.6. La cadence de publication en dit autant sur la stratégie du groupe que sur le modèle lui-même. Et face aux offensives d’OpenAI et d’Anthropic, la firme de Mountain View multiplie les mises à jour pour verrouiller le marché. Ce nouveau moteur s’impose en effet comme la nouvelle base par défaut de l’écosystème Google pensée pour réduire les coûts de l’IA.
Quant à son déploiement, il illustre la bataille d’usure que se livrent les géants de la tech sur le segment de l’IA à faible latence. C’est-à-dire qu’en renouvelant son modèle rapide pour la quatrième fois en moins d’un an, Google cherche à sécuriser les usages volumétriques du quotidien et le développement d’agents autonomes.
L’objectif est alors de réduire les coûts d’inférence chez les développeurs et les entreprises, tout en accélérant l’intégration de Gemini du côté du grand public.
Un modèle taillé pour le volume plutôt que la démonstration
Dans l’architecture de Google, la déclinaison Flash n’a pas pour vocation de dominer les classements bruts de puissance. Sa mission consiste à encaisser l’immense majorité des requêtes quotidiennes à grande vitesse. C’est ce moteur invisible qui répond aux utilisateurs dans l’application Gemini ou qui assure le dépannage discret des smartphones Pixel.
Pour imposer cette mise à jour, Google revoit ses tarifs à la baisse. Jusqu’à la fin de l’année 2026, Gemini 3.7 Flash est proposé au tarif d’introduction de 0,75 $ par million de jetons en entrée et 3,75 $ par million en sortie, soit une réduction de 50 % par rapport au prix initial de la version 3.6.
Historique du rythme de déploiement de la gamme Gemini Flash
| Modèle | Date de sortie | Orientation principale | Tarif d’entrée (1M tokens) | Tarif de sortie (1M tokens) |
| Gemini 3.0 Flash | Décembre 2025 | Modes de réflexion et réactivité | Tarif standard | Tarif standard |
| Gemini 3.5 Flash | Mai 2026 | Optimisation de la latence | Tarif ajusté | Tarif ajusté |
| Gemini 3.6 Flash | Juillet 2026 | Traitement multimodal et code | 1,50 $\vert{} 7,50$ | |
| Gemini 3.7 Flash | Août 2026 | Workflows agentiques et développement | 0,75 $ (Offre 2026) \vert{} 3,75$ (Offre 2026) |
Le contraste avec le haut de gamme et l’attente de Gemini 4
Ce tempo soutenu sur le créneau des modèles légers tranche avec les retards observés sur le haut de gamme. Gemini 3.5 Pro, la déclinaison à forte capacité de raisonnement promise aux utilisateurs exigeants, reste bloquée en phase de test fermé chez une poignée de partenaires stratégiques.
Enchaîner les itérations de son modèle polyvalent permet ainsi à Google de maintenir une présence médiatique et technique continue, alors que l’entreprise a déjà confirmé que la génération suivante, Gemini 4, était en cours de préparation dans ses laboratoires.
- Partager l'article :
Restez à la pointe de l'information avec
INTELLIGENCE-ARTIFICIELLE.COM !

