Pas besoin d’abonnement, la TT-QuietBox 2 installe la puissance du cloud directement sous votre bureau

Suivez Intelligence-Artificielle

La start-up américaine Tenstorrent vient de lancer la TT-QuietBox 2, une station de travail qui brise les codes de l’intelligence artificielle générative. Cette machine compacte et silencieuse n’est pas un simple PC : c’est un centre de données miniature capable d’exécuter les modèles de langage les plus lourds sans même avoir besoin d’une connexion internet. 

C’est une petite révolution pour les professionnels qui cherchent à allier performance brute, sécurité totale et souveraineté numérique.

Une station de travail taillée pour l’IA locale et la confidentialité

Jusqu’à présent, pour profiter de la puissance d’un modèle comme GPT-4 ou Llama 3, il fallait presque systématiquement passer par le cloud

Youtube video

Ce modèle centralisé pose trois problèmes majeurs en 2026. Dont l’explosion des coûts d’infrastructure et la latence réseau. Mais surtout le risque de fuite de données sensibles sur des serveurs distants

Sans oublier l’impact thermique et énergétique colossal des centres de données traditionnels, qui commence à inquiéter sérieusement les chercheurs.

La TT-QuietBox 2 propose une approche radicalement différente. En faisant tourner les modèles directement sur le poste de travail, Tenstorrent élimine la dépendance au réseau

Vous pouvez désormais rédiger, coder ou analyser des données sensibles dans un environnement totalement hors ligne.

Ce qui garantit que vos informations ne quittent jamais les murs de votre entreprise ou de votre domicile.

La fiche technique qui donne le vertige

Pour réussir l’exploit de faire tourner des modèles de plus de 100 milliards de paramètres dans un format silencieux, Tenstorrent a mis au point une architecture hybride impressionnante. 

Sous le capot, on retrouve quatre processeurs Blackhole, embarquant chacun 120 accélérateurs d’IA Tensix.

Mais c’est du côté de la mémoire que la machine impressionne le plus. Avec un cumul de ressources nécessaire pour charger les poids des modèles les plus massifs :

Mémoire Totale=128 Go (GDDR6)+256 Go (DDR5)=384 Go\text{Mémoire Totale} = 128 \text{ Go (GDDR6)} + 256 \text{ Go (DDR5)} = 384 \text{ Go}

Cette configuration permet d’atteindre des vitesses d’exécution proches de 500 jetons par seconde. À titre de comparaison, c’est suffisant pour faire fonctionner des modèles comme GPT-OSS-120B, Llama 3.1 70B ou Mixtral 8x7B. Cela avec une fluidité identique, voire supérieure, à celle des services cloud payants.

Reprendre le contrôle de sa souveraineté numérique

Au-delà de la simple performance technique, la TT-QuietBox 2 est un outil de liberté. Elle permet aux organisations d’affiner (fine-tuning) leurs modèles sur leurs propres bases de connaissances en toute autonomie. 

C’est un argument de poids pour les secteurs régulés (santé, défense, finance) qui ne peuvent pas se permettre d’exposer leurs secrets de fabrication à des plateformes tierces.

En démocratisant l’accès à une IA autonome et personnalisable, Tenstorrent préfigure peut-être le futur de l’informatique personnelle

À terme, posséder son propre système d’IA, indépendant des géants du Web, pourrait devenir la norme pour garantir une véritable souveraineté technologique à chaque utilisateur.

Restez à la pointe de l'information avec
INTELLIGENCE-ARTIFICIELLE.COM !

Abonnez-vous à notre chaîne YouTube et rejoignez-nous sur Actualités

ARTICLES SIMILAIRES

Anthropic veut concevoir ses propres puces pour Claude

Anthropic se lance à son tour dans la conception de puces dédiées à l’intelligence artificielle. La startup américaine a confirmé la création d’une équipe interne

10 août 2026

MacPaw s’associe à Liquid AI pour transformer l’IA sur Mac 

MacPaw s’associe à Liquid AI pour pousser plus loin l’intelligence artificielle locale sur macOS. Alors que de nombreux outils reposent encore sur des infrastructures cloud,

7 août 2026

CloudTalk : logiciel de call center IA et téléphonie d’entreprise

CloudTalk gère les appels professionnels pour les équipes de vente et de support inbound et outbound, avec une infrastructure de téléphonie complète incluant un IVR

31 juillet 2026

Moonshot AI veut entraîner Kimi K4 avec les GPU Blackwell 

Malgré les restrictions américaines sur les exportations de puces vers la Chine, Moonshot AI ne compte pas ralentir ses ambitions. La startup chinoise chercherait à

30 juillet 2026

Nubia présente le NaviX Ultra et son agent IA

Le NaviX Ultra de Nubia veut changer la manière dont nous utilisons un smartphone. Au lieu de se limiter à répondre aux demandes de l’utilisateur,

21 juillet 2026

NVIDIA Rubin adopte un système de refroidissement liquide à 45 °C

NVIDIA prépare un changement important dans la conception de ses supercalculateurs dédiés à l’intelligence artificielle. Avec sa nouvelle architecture Rubin, le constructeur abandonne le refroidissement

21 juillet 2026