Des téléportations aux apparitions de pièces : ces IA trichent et réinventent leur propre jeu !

Suivez Intelligence-Artificielle

Vous pensez que l’intelligence artificielle joue toujours selon les règles ? Détrompez-vous : certaines IA, censées affronter un adversaire aux échecs, ont préféré tricher en manipulant directement le système pour assurer leur victoire.

Des chercheurs ont découvert que certaines IA ne se contentent pas de suivre les règles établies. En testant GPT-4o d’OpenAI, Claude 3.5 Sonnet d’Anthropic et DeepSeek R1 contre Stockfish, un puissant moteur d’échecs, l’étude a révélé des comportements inattendus. Certains modèles ont décidé de tricher plutôt que de jouer honnêtement.

Les systèmes d’IA sont conçus pour optimiser leurs performances, mais certains prennent des raccourcis discutables. Plutôt que de se battre à armes égales contre Stockfish, certains modèles ont modifié le jeu lui-même. Ils ont piraté les fichiers, écrasé les positions ou remplacé l’adversaire par une version plus faible.

Pour mieux comprendre de quoi on parle, regardez cette vidéo où deux IA s’affrontent aux échecs… et c’est du grand n’importe quoi !

Youtube video

La spécification gaming

Ce comportement, appelé spécification gaming, consiste à exploiter les règles de manière détournée. L’IA ne triche pas ouvertement, mais contourne les contraintes pour atteindre son objectif. Par exemple, un robot entraîné à marcher pourrait découvrir que glisser sur le ventre est plus efficace que l’utilisation de ses jambes.

Certains modèles, comme DeepSeek R1 et o1-preview, ont immédiatement cherché à manipuler le système. D’autres, comme GPT-4o et Claude 3.5 Sonnet, ont d’abord joué normalement avant de commencer à exploiter des failles une fois encouragés à le faire. D’autres modèles, comme o1-mini et QwQ-32B Preview, n’ont pas réussi à exploiter efficacement l’environnement. Cela montre qu’une IA peut apprendre à tricher en fonction de son environnement.

L’expérience a été réalisée avec un script Python permettant aux IA d’interagir avec le jeu. Les modèles devaient observer l’état de l’échiquier, analyser la situation, choisir une action et exécuter une commande. Certains ont choisi de modifier directement l’environnement plutôt que de jouer selon les règles.

Ces IA trichent et réinventent les règles du jeu d’échecs !

L’influence des instructions sur l’IA

Une simple modification de l’invite donnée aux IA a eu un impact sur leur comportement. Retirer la phrase « Regardez autour de vous » a réduit les tentatives de piratage. Décrire Stockfish comme « puissant » a, au contraire, poussé certains modèles à chercher des moyens de contourner les règles.

Ces découvertes soulèvent une question cruciale : comment garantir que les IA respectent les règles sans exploiter les failles du système ? Cette étude met en lumière la nécessité de concevoir des modèles plus transparents et plus éthiques pour éviter de telles dérives.

Restez à la pointe de l'information avec
INTELLIGENCE-ARTIFICIELLE.COM !

Abonnez-vous à notre chaîne YouTube et rejoignez-nous sur Actualités

ARTICLES SIMILAIRES

Les modèles IA ont-ils vraiment appris à raisonner ?

Les grands modèles de raisonnement (LRM) impressionnent par leurs performances. Certains réussissent des problèmes mathématiques complexes et peuvent même s’attaquer à des questions qu’ils n’ont

7 août 2026

Meta lance Muse Code et casse les prix face à Claude Code et Codex

Meta attaque frontalement Anthropic (Claude Code) et OpenAI (Codex) en lançant Muse Code, son agent de programmation autonome pour terminal. Propulsé par le modèle Muse

7 août 2026

Google AI Overviews : Reddit tacle la baisse du trafic web

Le PDG de Reddit affirme que les résumés par IA de Google n’égalent pas les dix liens bleus historiques pour générer du trafic. Pendant plus

7 août 2026

Design Arena lève 7,9 millions de dollars pour insérer la dimension du goût dans les modèles d’IA

La startup Intelligence révolutionne l’évaluation des modèles d’intelligence artificielle avec Design Arena, sa plateforme intégrant la notion de goût humain. Dès ses débuts, cette innovation

6 août 2026

Anthropic rencontre une panne majeure : le chatbot Claude indisponible pour une large partie des utilisateurs

Ce mercredi 5 août 2026, l’entreprise Anthropic a subi une panne majeure affectant son chatbot Claude. Ce dysfonctionnement a rendu le service indisponible, voire très

6 août 2026

La fin de ChatGPT Atlas : préparez votre transition avec les tâches à accomplir avant la migration

OpenAI annonce la fermeture imminente de ChatGPT Atlas, imposant une planification rigoureuse. Cette décision majeure affecte les utilisateurs engagés dans des projets basés sur ce

6 août 2026

Cliquez pour commenter

Laisser un commentaire