Google poursuivi pour l’entraînement de Gemini avec des livres protégés 

Suivez Intelligence-Artificielle

Trois grands groupes d’édition et l’écrivain américain Scott Turow poursuivent Google en justice à New York. Ils accusent l’entreprise d’avoir utilisé des millions d’ouvrages protégés par le droit d’auteur pour entraîner ses modèles d’intelligence artificielle Gemini, sans autorisation préalable des ayants droit.

La plainte a été déposée le 14 juillet 2026 devant le tribunal fédéral du district sud de New York. Les plaignants estiment que Google aurait commis l’une des violations les plus importantes jamais observées dans l’histoire récente des litiges liés au droit d’auteur numérique. L’entreprise n’a pas encore livré sa défense dans cette nouvelle procédure.

Éditeurs et auteurs s’attaquent à Google

La plainte réunit trois acteurs majeurs du secteur de l’édition : Hachette Book Group, Cengage Learning et Elsevier. Ils sont accompagnés par l’écrivain Scott Turow, connu pour ses romans judiciaires, ainsi que par l’organisation d’auteurs S.C.R.I.B.E.

Youtube video

Les plaignants reprochent à Google d’avoir utilisé leurs catalogues pour entraîner ses modèles d’IA générative Gemini. Selon eux, des millions de livres auraient été utilisés comme données d’apprentissage sans accord des auteurs ni compensation financière. L’objectif de cette procédure est d’obtenir des dommages et intérêts, mais aussi d’imposer à Google la suppression des copies utilisées pour développer ses modèles.

Des contenus issus de services comme Google Books au cœur du conflit

Au cœur du conflit se trouvent plusieurs bases de données exploitées depuis des années par Google. Les éditeurs expliquent avoir fourni des ouvrages à l’entreprise dans le cadre de services comme Google Books, Google Play Books ou Google Scholar, avec des conditions d’utilisation précises. Ces accords permettaient l’affichage d’extraits ou la distribution encadrée de versions numériques. 

D’après la plainte, Google aurait toutefois réutilisé ces contenus pour entraîner ses systèmes d’intelligence artificielle, dépassant ainsi le cadre initialement prévu. Les plaignants affirment également que l’entreprise aurait supprimé ou modifié certaines informations liées aux droits d’auteur afin de compliquer l’identification de l’origine des œuvres utilisées.

Des documents internes au centre de la plainte

Pour soutenir leurs accusations, les éditeurs citent plusieurs documents internes de Google. Ces échanges montrent que certains employés étaient conscients des risques juridiques liés à l’utilisation de livres issus de Google Play Books pour entraîner des modèles d’IA. Selon la plainte, des analyses internes auraient évalué les conséquences financières potentielles d’une utilisation non autorisée de ces contenus à plusieurs dizaines de milliards de dollars.

Les éditeurs soulignent aussi l’impact économique potentiel de l’IA générative sur l’industrie du livre. Ils citent notamment l’exemple d’un modèle capable de produire un roman policier d’une centaine de pages en quelques dizaines de minutes pour un coût très faible. Parmi les œuvres mentionnées dans la procédure figurent The Fifth Season de N.K. Jemisin et Who Could That Be at This Hour? de Lemony Snicket.

Une nouvelle bataille autour des données d’entraînement de l’IA

Cette affaire s’inscrit dans un conflit plus large entre les créateurs de contenus et les entreprises qui développent des modèles d’intelligence artificielle. Google, mais aussi OpenAI, Meta ou Anthropic, font face à plusieurs procédures concernant l’utilisation d’œuvres protégées pour entraîner leurs systèmes.

Le débat reste particulièrement sensible aux États-Unis, où les tribunaux tentent encore de définir les limites du « fair use » appliqué à l’IA générative. En septembre 2025, Anthropic a notamment conclu un accord à l’amiable d’au moins 1,5 milliard de dollars avec des auteurs et des éditeurs afin de mettre fin à un litige portant sur l’utilisation d’œuvres numérisées pour l’entraînement de son modèle Claude.

L’issue de la procédure visant Google pourrait à son tour influencer la manière dont les entreprises d’IA devront obtenir, exploiter ou rémunérer les contenus utilisés pour développer leurs modèles.

Restez à la pointe de l'information avec
INTELLIGENCE-ARTIFICIELLE.COM !

Abonnez-vous à notre chaîne YouTube et rejoignez-nous sur Actualités

ARTICLES SIMILAIRES

Google sous pression : la presse conteste ses résumés IA en France

L’Alliance de la presse d’information générale (APIG) a saisi l’Autorité de la concurrence pour contester le déploiement en France des résumés générés par l’IA de

14 août 2026

L’APIG saisit l’Autorité de la concurrence contre Google

L’APIG saisit l’Autorité de la concurrence contre Google après le lancement des « AI Overviews » en France le 22 juillet 2026. Ces résumés générés par intelligence

13 août 2026

AI Act : qui doit piloter l’IA dans une petite entreprise ?

Depuis le 2 août 2026, l’AI Act est entré dans une phase d’application concrète. Pour Jean-François Deldon, CEO de Yakadata, les TPE et PME doivent

10 août 2026

Comprendre pourquoi les utilisateurs souhaitent désactiver l’intelligence artificielle de Google

Depuis l’été 2026, les fonctionnalités d’intelligence artificielle intégrées directement dans Google modifient profondément l’expérience des utilisateurs. Si la promesse d’outils plus intuitifs et efficaces séduit,

5 août 2026

AI Act : les obligations de transparence débutent

L’AI Act impose de nouvelles règles de transparence aux entreprises européennes. Derrière l’échéance juridique, la qualité et la traçabilité des données deviennent le vrai test.

2 août 2026

Interdiction des réseaux sociaux aux moins de 15 ans : la loi française va-t-elle trop loin ?

Le 21 juillet 2026 marquera un tournant dans l’histoire du numérique français. L’Assemblée nationale a voté une interdiction des réseaux sociaux aux de 15 ans,

29 juillet 2026