Gemini 3.7 Flash : Google accélère la cadence face à la concurrence 

Suivez Intelligence-Artificielle

Google ajoute Gemini 3.7 Flash à sa gamme d’intelligence artificielle, quelques semaines seulement après le lancement de la version 3.6. La cadence de publication en dit autant sur la stratégie du groupe que sur le modèle lui-même. Et face aux offensives d’OpenAI et d’Anthropic, la firme de Mountain View multiplie les mises à jour pour verrouiller le marché. Ce nouveau moteur s’impose en effet comme la nouvelle base par défaut de l’écosystème Google pensée pour réduire les coûts de l’IA. 

Quant à son déploiement, il illustre la bataille d’usure que se livrent les géants de la tech sur le segment de l’IA à faible latence. C’est-à-dire qu’en renouvelant son modèle rapide pour la quatrième fois en moins d’un an, Google cherche à sécuriser les usages volumétriques du quotidien et le développement d’agents autonomes

L’objectif est alors de réduire les coûts d’inférence chez les développeurs et les entreprises, tout en accélérant l’intégration de Gemini du côté du grand public.

Un modèle taillé pour le volume plutôt que la démonstration

Dans l’architecture de Google, la déclinaison Flash n’a pas pour vocation de dominer les classements bruts de puissance. Sa mission consiste à encaisser l’immense majorité des requêtes quotidiennes à grande vitesse. C’est ce moteur invisible qui répond aux utilisateurs dans l’application Gemini ou qui assure le dépannage discret des smartphones Pixel.

Youtube video

Pour imposer cette mise à jour, Google revoit ses tarifs à la baisse. Jusqu’à la fin de l’année 2026, Gemini 3.7 Flash est proposé au tarif d’introduction de 0,75 $ par million de jetons en entrée et 3,75 $ par million en sortie, soit une réduction de 50 % par rapport au prix initial de la version 3.6.

Historique du rythme de déploiement de la gamme Gemini Flash

ModèleDate de sortieOrientation principaleTarif d’entrée (1M tokens)Tarif de sortie (1M tokens)
Gemini 3.0 FlashDécembre 2025Modes de réflexion et réactivitéTarif standardTarif standard
Gemini 3.5 FlashMai 2026Optimisation de la latenceTarif ajustéTarif ajusté
Gemini 3.6 FlashJuillet 2026Traitement multimodal et code1,50 $\vert{} 7,50$
Gemini 3.7 FlashAoût 2026Workflows agentiques et développement0,75 $ (Offre 2026) \vert{} 3,75$ (Offre 2026)

Le contraste avec le haut de gamme et l’attente de Gemini 4

Ce tempo soutenu sur le créneau des modèles légers tranche avec les retards observés sur le haut de gamme. Gemini 3.5 Pro, la déclinaison à forte capacité de raisonnement promise aux utilisateurs exigeants, reste bloquée en phase de test fermé chez une poignée de partenaires stratégiques.

Youtube video

Enchaîner les itérations de son modèle polyvalent permet ainsi à Google de maintenir une présence médiatique et technique continue, alors que l’entreprise a déjà confirmé que la génération suivante, Gemini 4, était en cours de préparation dans ses laboratoires.

Restez à la pointe de l'information avec
INTELLIGENCE-ARTIFICIELLE.COM !

Abonnez-vous à notre chaîne YouTube et rejoignez-nous sur Actualités

ARTICLES SIMILAIRES

GPT-6 Astra, l’AGI que nous attendions tous est-elle enfin atteinte ?

La dernière étape vers l’AGI ? Peut-être que oui, peut-être que non ! OpenAI a en tout cas lancé un nouveau modèle d’intelligence artificielle qu’ils

8 septembre 2026

Découvrez les nouveautés de Qwen 3.8-flash-next et ses performances optimisées

Qwen 3.8-flash-next, le modèle développé par Alibaba, révolutionne les standards grâce à une architecture hybride à grande échelle. Il intégre 125 milliards de paramètres avec

7 septembre 2026

GLM de Z.ai : tout savoir sur la version 5.2

La version 5.2 du modèle GLM de Z.ai est lonçu pour exceller dans des tâches à long terme. C’est d’ailleurs un modèle à poids ouverts

4 septembre 2026

Anthropic continue d’imposer son rythme avec le lancement de Claude Fable 5.1 et Mythos 5.1

Déjà couronné par les performances de ses modèles Opus 5 et Fable 5, l’éditeur consolide son avance sur le marché des intelligences artificielles avec le

2 septembre 2026

On a regardé de près DeepSeek V4-Pro, le nouveau rival de GPT-5 et Claude Opus 

Le 12 août 2026, DeepSeek a officialisé la sortie de V4-Pro, son modèle phare. Ce système compte 1,6 billion de paramètres, dont 49 milliards actifs

17 août 2026

vLLM : une bibliothèque open source pour libérer la puissance des LLM

Propulsé par PagedAttention, le moteur d’inférence open source vLLM transforme l’exécution des grands modèles de langage. Il réduit la fragmentation VRAM d’un facteur vingt et

17 août 2026