Recherche IA : 94 % d’erreurs dans les réponses de Grok 3

Suivez Intelligence-Artificielle

Vous pensiez pouvoir faire confiance aux intelligences artificielles pour vos recherches en ligne ? Attendez de voir ce que révèle cette étude sur Grok 3, qui multiplie les erreurs dans presque tous les cas.

Une récente étude menée par le Tow Center for Digital Journalism a révélé des failles inquiétantes. En testant huit moteurs de recherche basés sur l’IA, les chercheurs ont constaté un taux d’erreur global dépassant les 60 %. L’outil le moins performant du groupe est Grok 3, développé par xAI, société d’Elon Musk. Avec 94 % de réponses incorrectes, il se positionne comme le moins fiable du panel examiné.

Les chercheurs ont soumis à ces IA des extraits d’articles pour évaluer leur précision. L’objectif était d’identifier correctement l’éditeur, la date, l’URL et la source d’origine. Dans la majorité des cas, les systèmes se sont trompés sur plusieurs points essentiels. Des erreurs de dates, des noms d’éditeurs mal cités, des articles attribués à des sources erronées sont monnaie courante. Ces résultats remettent en question l’efficacité des IA comme outils de recherche d’actualité.

En plus de répondre de manière inexacte, certains assistants génératifs créent des liens vers des pages inexistantes. Grok 3 et Gemini redirigent vers des URL erronées dans plus de la moitié des cas testés. Ce problème empêche les utilisateurs de vérifier les informations et nuit à la crédibilité globale des outils. Même lorsqu’un article est correctement identifié, le lien fourni est parfois incorrect et renvoie à la page d’accueil plutôt qu’au contenu précis.

Youtube video

Chatbots muets sur leurs erreurs

Les chatbots testés informent rarement l’utilisateur de leur incertitude. Par exemple, ChatGPT a fourni 134 mauvaises réponses sur 200 requêtes. Pourtant, il n’a signalé un manque de confiance que dans 15 cas seulement. Seul Copilot a montré un comportement plus prudent. Ce dernier a refusé de répondre à une majorité des requêtes. Cette transparence partielle aggrave le risque de diffusion d’informations erronées.

Une menace pour les éditeurs de presse

Les moteurs d’IA s’appuient largement sur le contenu des éditeurs de presse, sans toujours respecter les règles de citation. Plusieurs outils analysés attribuent fréquemment les articles à de mauvaises sources. Pire encore, certains chatbots citent des versions publiées par des intermédiaires ou des agrégateurs, plutôt que par le média d’origine. Cette confusion nuit au trafic web des éditeurs et compromet l’accès aux sources fiables.

Même les IA ayant conclu des accords avec certains médias commettent des erreurs de citation. Des outils comme Perplexity et ChatGPT continuent de référencer des sources inexactes, malgré ces partenariats. Cela montre que les accords commerciaux ne suffisent pas à améliorer la qualité des réponses générées.

Youtube video

L’étude souligne que ces dysfonctionnements concernent tous les modèles testés, sans exception. Aucun n’a démontré une maîtrise suffisante du traitement de l’information. Tant que ces IA ne seront pas plus rigoureuses, elles resteront inadaptées à la recherche d’actualités fiables. Pour l’instant, c’est encore à l’utilisateur de trier, vérifier, comparer et corriger.

Et vous, avez-vous déjà repéré ce genre d’erreurs avec Grok 3 ? Partagez vos expériences en commentaire !

Restez à la pointe de l'information avec
INTELLIGENCE-ARTIFICIELLE.COM !

Abonnez-vous à notre chaîne YouTube et rejoignez-nous sur Actualités

ARTICLES SIMILAIRES

Tout savoir sur Claude Cowork : le guide complet de l’agent IA d’Anthropic

Cette nouvelle infrastructure agentique transforme radicalement votre application de bureau en un véritable collaborateur opérationnel. Claude Cowork permet d’exécuter des missions complexes directement sur vos

20 juillet 2026

Comment créer un GPT personnalisé pas à pas 

Créer un GPT personnalisé devient rapidement une compétence stratégique dans l’univers de l’intelligence artificielle. Cette approche permet de concevoir des assistants capables d’automatiser des tâches

20 juillet 2026

Maîtrisez l’IA agentique avec ce guide complet sur IBM watsonx Orchestrate

La plateforme IBM watsonx Orchestrate transforme radicalement la manière dont les organisations automatisent leurs processus complexes. Elle permet effectivement de passer d’une intelligence artificielle qui

19 juillet 2026

Le guide complet du modèle Mistral Medium 3.5 et de son écosystème agentique

L’arrivée de Mistral Medium 3.5 bouleverse les standards actuels de l’intelligence artificielle en Europe. Ce nouveau fleuron technologique réunit la puissance du code et la

19 juillet 2026

Quelles sont les nouvelles mises à jour de Gemini en 2026 ?

En cette année 2026, Gemini a de nouveau franchi un seuil structurel avec l’intention de transformer l’IA en une infrastructure cognitive intégrée. Plusieurs nouveautés sont

10 juillet 2026

Import Memory, la fonction ultime pour transférer vos données de ChatGPT vers Claude

Alors que Claude caracole en tête des téléchargements sur l’App Store américain, sa nouvelle fonctionnalité « Import Memory » permet désormais de transférer l’intégralité de ses préférences

10 juillet 2026

Cliquez pour commenter

Laisser un commentaire