Nano Banana 2 Lite est disponible, et Omni Flash bénéficie de plusieurs nouveautés

Suivez Intelligence-Artificielle

Pour refaire son retard sur le marché de la création de contenus par intelligence artificielle, Google déploie une double mise à jour stratégique axée sur la réduction des coûts et l’accélération de la vitesse de traitement.

La firme de Mountain View vient en effet d’annoncer la sortie de Nano Banana 2 Lite, une déclinaison ultra-rapide et économique de son modèle de génération d’images. 

Parallèlement, le géant américain ouvre l’accès de son API Gemini aux développeurs pour Gemini Omni Flash, son modèle de génération et de montage vidéo multimodal dévoilé en mai dernier lors de la conférence Google I/O.

La quête de la vitesse avec Nano Banana 2 Lite

Disponible dans Google AI Studio depuis le mardi 30 juin 2026, Nano Banana 2 Lite a été conçu spécifiquement pour l’idéation rapide et les pipelines de développement à haute fréquence. 

Youtube video

Google cible les scénarios de production de masse où la vitesse d’exécution et la maîtrise des coûts s’avèrent plus cruciales que l’obtention d’une qualité d’image maximale.

Ce modèle se distingue par des performances techniques et budgétaires très agressives. Dont une meilleure vitesse d’exécution, un coût d’inférence avantageux, et une meilleure qualité du rendu.

Il génère en effet une image complète à partir d’un prompt textuel en seulement 4 secondes, un atout pour le prototypage interactif.

La facturation quant à elle, est fixée à 0,034 dollar pour 1 000 images. Et les benchmarks de la firme indiquent une bonne fidélité aux instructions, une cohérence dans le rendu des personnages et une excellente lisibilité des textes intégrés.

Mais pour maximiser son adoption, Google déploie immédiatement cette déclinaison Lite sur plusieurs de ses services phares. Notamment l’application grand public Gemini, NotebookLM, Google Photos et la plateforme publicitaire Google Ads.

Google encore en retard face à OpenAI

Google reste, à titre d’information, à la traîne face à OpenAI sur le segment de la création graphique. 

Les classements de juin 2026 de la Text-to-Image Arena d’Artificial Analysis révèlent d’ailleurs que les modèles concurrents GPT Image 2 and GPT Image 1.5 surclassent nettement Nano Banana 2 et Nano Banana Pro en matière de performances pures.

Et en introduisant une version Lite ultra-économique, Google fait le choix pragmatique de ne pas rivaliser immédiatement sur la puissance brute, mais d’occuper le terrain des flux de travail de masse à bas coût, incitant au passage les utilisateurs à abandonner définitivement la première version historique de Nano Banana.

Ce qui pourrait être mon cas, parce que les résultats actuels de Nano Banana ne me satisfassent guère

GPT Image vs Nano banana 2 score benchmarks
© Artificial Analysis

Gemini Omni Flash intègre de nouvelles fonctionnalités vidéo

Auparavant réservé aux abonnés des forfaits Google AI Plus, Pro et Ultra, le modèle multimodal Gemini Omni Flash rejoint désormais Google AI Studio et l’API en préversion publique. 

Ce système associe le raisonnement de Gemini à la génération et au montage de fichiers vidéo à travers trois atouts majeurs. Notamment un montage conversationnel, un référencement multimodal, et une cohérence avec le monde réel. 

Vous pouvez, en tant que développeur, affiner et modifier précisément vos séquences en envoyant plusieurs instructions textuelles successives.

L’algorithme est également capable de combiner des entrées textuelles, des images et des séquences vidéo pour concevoir des scènes cohérentes.

Et pour générer des représentations convaincantes, l’IA s’appuie sur le socle de connaissances globales de Gemini. Notamment en histoire et en biologie.

Youtube video

Des nouveautés intéressantes, mais à quel prix ?

Facturé 0,10 dollar par seconde de génération, un tarif identique à celui de Veo 3.1 Fast, le modèle présente toutefois plusieurs limites techniques à ce stade. 

Les vidéos générées sont plafonnées à 10 secondes. Mais l’API ne prend pas encore en charge l’importation de fichiers audio ni l’extension de scène

Par ailleurs, les vidéos de référence de plus de 3 secondes ne sont pas correctement traitées. Et la cohérence des personnages montre des faiblesses lors des mouvements de panoramique ou des changements de scène.

Restez à la pointe de l'information avec
INTELLIGENCE-ARTIFICIELLE.COM !

Abonnez-vous à notre chaîne YouTube et rejoignez-nous sur Actualités

ARTICLES SIMILAIRES

« L’AGI est arrivée », la déclaration du patron de Nvidia qui fait débat et dont la communauté scientifique n’est pas d’accord

À la suite du lancement très remarqué du modèle GPT-6 Astra par OpenAI, le PDG de Nvidia, Jensen Huang, a officiellement proclamé que l’intelligence artificielle

8 septembre 2026

Open Spoken AI revendique une écriture intelligente libérée des filtres de discours

Open Spoken AI se présente comme un générateur de texte non censuré destiné aux marketeurs et aux auteurs. La plateforme revendique une liberté éditoriale que

7 septembre 2026

ElevenLabs : La référence du text-to-speech et du clonage vocal IA

Découvrez ElevenLabs, la référence mondiale du Text-to-Speech et du clonage vocal. Notre analyse décortique ses fonctionnalités, ses tarifs 2026 et ses performances concrètes. Le marché

4 septembre 2026

Avis Rytr.me : l’assistant IA de rédaction est-t-il pertinent en 2026 ?

Avis Rytr.me : l’assistant IA de rédaction est-t-il pertinent en 2026 ?

La plateforme Rytr.me aide plus de 8 millions de créateurs à accélérer leur rédaction web au quotidien. Cet assistant IA puissant génère vos contenus courts,

29 août 2026

Test de Descript : avis complet de l’outil IA hybride de sous-titrage et montage

Connaître les limites et les atouts d’une solution avant de s’engager est essentiel pour optimiser sa production vidéo. Si Submagic est le maître incontesté pour

28 août 2026

La nouvelle IA de Google supprime vos ‘euh’ et ‘hum’ dans les transcriptions

Google révolutionne la transcription audio avec une intelligence artificielle capable d’éliminer les hésitations vocales courantes. Cette avancée transforme l’expérience utilisateur en produisant des textes plus

27 août 2026