Gemini 3.5 Flash : Google déploie la fonctionnalité de contrôle de l’ordinateur

Suivez Intelligence-Artificielle

Le 24 juin, Google a lancé Gemini 3.5 Flash Computer Use. Cet outil permet aux agents d’IA de piloter directement des ordinateurs, des navigateurs et des téléphones.

Cette mise à jour cible surtout les développeurs. Elle leur permet de créer des agents d’IA capables d’agir sur des environnements numériques réels. Les cas d’usage sont concrets : tests logiciels automatisés, vérification de documents et travaux bureautiques. Google positionne ainsi Gemini 3.5 Flash comme une solution d’automatisation opérationnelle pour les entreprises.

Comment fonctionne l’outil Computer Use de Gemini 3.5 Flash ?

L’outil Gemini 3.5 Flash Computer Use donne à un agent d’IA la capacité de voir un écran et d’interagir avec lui. Il peut cliquer sur un icône, saisir des textes ou faire défiler l’écran. Selon Google, cette capacité est intégrée nativement dans le modèle, sans module externe. Un agent peut ainsi ouvrir un navigateur, remplir un formulaire, lancer un test logiciel ou parcourir un document de façon en totale autonomie. 

Youtube video

Cette architecture change la donne pour les développeurs. Auparavant, l’utilisation de l’ordinateur par un agent nécessitait des outils séparés, souvent difficiles à coordonner. Désormais, tout s’effectue au sein d’un seul modèle. Les dévéloppeurs bénéficient ainsi de la puissance de Gemini 3.5 Flash pour automatiser une grande partie de leurs projets. 

Un score de 78,4 % au benchmark OSWorld

OSWorld est un test de référence qui évalue la capacité d’un modèle à accomplir des tâches informatiques dans des conditions réelles. Ce test permet d’évaluer le comportement du modèle lors de la navigation dans une interface, l’identification une erreur dans un logiciel ou génération d’ un rapport. Selon Google, Gemini 3.5 Flash obtient un score de 78,4 % sur ce benchmark. Le modèle est considéré comme l’une des meilleures solutions d’automatisation disponibles.

Ce résultat positionne le modèle au même niveau que ses concurrents directs. Un agent basé sur Gemini 3.5 Flash peut gérer des tests d’assurance qualité sur une application web sans intervention humaine indique Google. Ces performances s’inscrivent dans la continuité des informations publiées sur le mystérieux Gemini 3.5, dont les aptitudes de raisonnement avaient déjà retenu l’attention des observateurs.

Quelles garanties de sécurité accompagnent cette mise à jour ?

L’intégration d’un outil capable de piloter un ordinateur soulève des questions légitimes sur les risques de piratages. Selon Google, deux mécanismes de sécurité sont intégrés dès le lancement. Le premier est un entraînement contradictoire. Pendant sa formation, le modèle est exposé à des tentatives de manipulation afin de renforcer sa résistance aux attaques. Le second est un système de confirmation utilisateur. Avant d’exécuter certaines actions sensibles, l’agent demande une validation explicite. Cette approche garantit un contrôle humain sur les opérations critiques, comme la modification de fichiers confidentiels, l’envoi d’e-mails automatisés ou l’accès à des systèmes internes.

La version Pro repoussée à juillet

Google prépare également une version Pro du modèle. Toutefois, selon la firme, sa sortie a été repoussée à juillet pour permettre des améliorations supplémentaires. En attendant, Gemini 3.5 Flash reste la version disponible pour les développeurs via l’API Google. La stratégie de Google est claire. Il veut déployer d’abord le modèle le plus rapide et le plus abordable, puis affiner la version haut de gamme.

Les premiers testeurs rapportent des retours positifs sur la rapidité d’exécution et la précision dans des workflows réels. Ces résultats rappellent les performances observées avec l’agent Daily Brief de Google, qui automatise déjà des tâches matinales pour ses utilisateurs. La fonctionnalité reste donc accessible en immédiat, dans un secteur où la concurrence entre modèles d’IA s’intensifie rapidement.

Restez à la pointe de l'information avec
INTELLIGENCE-ARTIFICIELLE.COM !

Abonnez-vous à notre chaîne YouTube et rejoignez-nous sur Actualités

ARTICLES SIMILAIRES

DeepSeek dépasse Google sur le volume de tokens IA

DeepSeek devient le deuxième laboratoire par volume de tokens sur le Vercel AI Gateway, devant Google. En juillet 2026, le coût moyen par token recule

15 août 2026

Google lance les agents IA sur Android : première phase de test avec 5 assistants Gemini

Google innove une fois de plus dans le domaine de la technologie mobile en lançant une phase de test majeure : l’intégration des agents IA

5 août 2026

Threads déploie l’assistant Meta AI au sein de sa messagerie privée

Meta déploie désormais son assistant Meta AI dans les messages privés de Threads. Cela offre aux utilisateurs la possibilité d’échanger en toute confidentialité avec le

30 juillet 2026

OpenAI annonce le lancement de sa plateforme Presence pour les entreprises

Selon OpenAI, leur solution Presence permet désormais de déployer des agents autonomes fiables en entreprise, capables de prendre en charge des tâches à forte valeur

26 juillet 2026

Agents IA : le coût caché des opérations automatiques

L’essor des agents d’intelligence artificielle soulève une nouvelle question pour les entreprises : le coût réel de leur autonomie. Au-delà du prix des modèles, le

23 juillet 2026

NotebookLM se transforme et devient Gemini Notebook

Google vient de rebaptiser son service documentaire NotbookLM  en Google Gemini Notebook. Ce produit totalement autonome voit ses capacités d’analyse s’élargir au sein de l’écosystème

21 juillet 2026