Ce mini-modèle d’IA à 7 millions de paramètres ridiculise les géants de la tech

Suivez Intelligence-Artificielle

Si Apple a caché un mini chatGPT sans ses iPhone, Samsung a aussi dévoilé une mini IA est plus performant que les LLM dans un raisonnement. Ils ont utilisé un TRM ou un Tiny Recursive Model. Alexia Jolicoeur-Martineau indique d’ailleurs que ce minimodèle de Samsung surpasse les modèles de langage volumineux.

Et sur les benchmarks, ce modèle écrase les LLM de raisonnement de grande taille, même avec ces quelque 7 millions de paramètres.

Oui, cela représente seulement 0,1 % de la taille des LLM que nous connaissons. Notamment GPT-5 d’OpenAI, Gemini 2.5 ou Claude 4.5 Sonnet.

Mais l’idée de Samsung contredit le fait que la taille est le seul facteur d’évaluation des performances d’un LLM.

Youtube video

Les grands modèles sont plus fragiles

Les grands modèles de langage (LLM) comme GPT ou Gemini sont connus pour leur puissance, mais aussi pour leur fragilité logique.

En générant leurs réponses jeton par jeton, ils sont susceptibles de commettre une erreur dès le départ. Cette dernière peut ensuite compromettre toute la suite du raisonnement.

Des méthodes comme la chaîne de pensée (Chain of Thought) ont tenté d’y remédier, mais elles restent coûteuses en calcul et peu fiables.

C’est face à ce constat que Samsung Research a décidé de repenser le concept même du raisonnement en IA.

Ils ont alors développé un modèle minimaliste, TRM, capable de raisonner, de s’autocorriger et d’améliorer sa réponse de manière itérative.

Comment fonctionne le nouveau mini-modèle d’IA de Samsung ?

Inspiré du précédent Modèle de Raisonnement Hiérarchique (HRM), le TRM s’appuie sur une idée simple.

Plutôt que de multiplier les réseaux neuronaux, il n’utilise qu’un seul petit réseau qui affine son raisonnement et sa réponse à chaque itération.

Concrètement, le modèle reçoit une question et une hypothèse initiale de réponse, passe par plusieurs étapes d’ajustement récursif pour améliorer son raisonnement interne et met à jour sa réponse finale jusqu’à 16 fois si nécessaire.

Grâce à cette approche, TRM peut corriger ses propres erreurs, tout en évitant les calculs complexes ou les théorèmes de convergence nécessaires au HRM.

Je tiens également à rappeler qu’une version à seulement deux couches obtient de meilleurs résultats qu’un modèle à quatre couches, car elle limite le sur-apprentissage.

Youtube video

Quelle est la clé du succès de TRM ?

Le secret réside dans un apprentissage plus intelligent. Samsung a introduit un mécanisme appelé ACT (Adaptive Computation Time), qui décide automatiquement quand le modèle a suffisamment amélioré une réponse avant de passer à la suivante.

Ce qui conduit à un entraînement plus rapide, donc moins coûteux et surtout sans perte de performance.

Cette simplification prouve qu’il n’est pas nécessaire de disposer d’énormes infrastructures pour atteindre un haut niveau de raisonnement.

Avec seulement 7 millions de paramètres, TRM offre une efficacité paramétrique exceptionnelle et pourrait bien inspirer une nouvelle génération de mini-modèles d’IA.

Le Tiny Recursive Model sur les benchmarks

Sur les Benchmarks, les chiffres parlent d’eux-mêmes. Et les performances affichées par le Tiny Recursive Model de Samsung dépassent largement les attentes :

  • Sudoku-Extrême : 87,4 % de précision (contre 55 % pour HRM) ;
  • Maze-Hard (labyrinthes 30×30) : 85,3 % (contre 74,5 %) ;
  • ARC-AGI, un test d’intelligence abstraite : 44,6 % sur ARC-AGI-1 et 7,8 % sur ARC-AGI-2.

À titre de comparaison, Gemini 2.5 Pro de Google obtient 4,9 % sur le même test. Autrement dit, Samsung parvient à battre les géants du secteur avec un modèle bien plus léger et économe.

Restez à la pointe de l'information avec
INTELLIGENCE-ARTIFICIELLE.COM !

Abonnez-vous à notre chaîne YouTube et rejoignez-nous sur Actualités

ARTICLES SIMILAIRES

Gemini 3.7 Flash : Google accélère la cadence face à la concurrence 

À peine trois semaines après le lancement de Gemini 3.6 Flash, Google enchaîne avec Gemini 3.7 Flash. Une frénésie de sorties qui illustre la guerre pour imposer le modèle de travail par défaut.

18 août 2026

On a regardé de près DeepSeek V4-Pro, le nouveau rival de GPT-5 et Claude Opus 

Le 12 août 2026, DeepSeek a officialisé la sortie de V4-Pro, son modèle phare. Ce système compte 1,6 billion de paramètres, dont 49 milliards actifs

17 août 2026

vLLM : une bibliothèque open source pour libérer la puissance des LLM

Propulsé par PagedAttention, le moteur d’inférence open source vLLM transforme l’exécution des grands modèles de langage. Il réduit la fragmentation VRAM d’un facteur vingt et

17 août 2026

Les algorithmes au service de la marque employeur : Comment l’IA transforme des milliers d’avis en ligne en données concrètes pour les RH ?

Les commentaires publiés par les salariés et les candidats révèlent des signaux précieux sur l’expérience professionnelle vécue au quotidien. Grâce à l’intelligence artificielle dans les

13 août 2026

AI Overviews et trafic web : quel est le réel impact sur votre SEO ?

Les études américaines mesurent l’impact des AI Overviews sur le trafic web après le lancement officiel de cette fonctionnalité Google le 22 juillet 2026. Google

2 août 2026

Ce que l’on sait de Gemini 3, le modèle d’IA le plus intelligent de Google

Le nouveau modèle d’intelligence artificielle de Google, Gemini 3, est officiellement disponible depuis le 18 novembre 2025. La sortie de cette nouvelle version, que j’ai

2 août 2026