Mardi 21 juillet derner, Google DeepMind a dévoilé Gemini 3.6 Flash et deux autres modèles économiques. Mais la très attendue version 3.5 Pro, elle, brille toujours par son absence.
Dans son annonce officielle, Google explique vouloir offrir des solutions plus rapides aux développeurs. Les trois nouveaux modèles de Gemini sont tout à fait efficaces. Cependant, le fait que le modèle phare de la firme ne soit toujours pas au rendez-vous soulève beaucoup de questions sur les capacités du labo.
Alors, pourquoi cette déferlante de nouveaux modèles ?
Google DeepMind veut réduire au maximum la latence pour les clients qui développent des agents d’intelligence artificielle. Parmi les nouveautés présentées par Google, Gemini 3.6 Flash est décrit comme un modèle « pilier ». L’entreprise indique que ce système consomme 17 % de jetons en moins pendant le traitement des requêtes. Il peut ainsi analyser de grosses bases de code avec moins de ressources. Il coûte de ce fait moins cher que le précédent Gemini 3.5 Flash.
Google a aussi lancé la version 3.5 Flash-Lite. Celle-ci est décrite comme le modèle le plus rentable de sa catégorie. Le 3.5 Flash Cyber excelle dans la détection des failles de cybersécurité. Cette version reste réservé aux gouvernements pour l’instant. Le modèle entre encore dans le cadre d’un programme pilote.
Où en est la version 3.5 Pro ?
La production du modèle fait face à des retards. D’après un rapport de Bloomberg publié la semaine dernière, Google galérerait en interne pour sortir cette version. Le média économique raconte que l’entreprise n’arrive pas à atteindre les objectifs de performance attendus pendant les tests. Pourtant, lors du lancement de la version Flash en mai, Google avait affirmé que le modèle Pro tournait déjà en interne.
Interrogé mardi 21 juillet dernier, Logan Kilpatrick, responsable produit chez Google DeepMind, a précisé que la société testait toujours la version avec ses partenaires. Il a aussi ajouté que l’équipe espérait en venir à bout bientôt, et qu’elle avait déjà commencé la phase de pré-entraînement pour la quatrième génération de son IA.
Flash vs Pro : des différences techniques bien nettes
Les fiches techniques de Google montrent une vraie séparation entre les deux gammes. D’un côté, les modèles Pro sont les plus costauds du laboratoire. Ils gèrent le raisonnement complexe et les tâches de programmation avancées. De l’autre, les modèles Flash sont conçus pour minimiser les coûts de fonctionnement, avec des temps de réponse ultra-rapides. Ce sont eux qu’on retrouve dans les applications en production qui exigent des interactions en temps réel.
Gemini 3.5 Flash-Lite is our fast, cost-effective model for scaling repetitive use cases like sorting tickets and extracting data.
— Google DeepMind (@GoogleDeepMind) July 21, 2026
Watch how it performs against 3.5 Flash on a series of high volume tasks ↓ pic.twitter.com/km2wa21mUJ
Une concurrence qui continue de s’intensifier
Ce retard survient au moment où la concurrence fait rage tombe mal dans un marché où la concurrence fait rage. Les laboratoires rivaux enchaînent les publications à un rythme soutenu. OpenAI vient par exemple de commencer à déployer son nouveau modèle GPT-5.6 Sol. De son côté, Anthropic a lancé ses modèles Claude Opus 4.8 et Claude Sonnet 5, et a élargi l’accès à son modèle de pointe, Fable 5. Autant de coups qui mettent la pression sur Google pour qu’il livre enfin sa propre mise à jour majeure.
- Partager l'article :
Restez à la pointe de l'information avec
INTELLIGENCE-ARTIFICIELLE.COM !
