CXL 2.0, la réponse des datacenters face à la pénurie de RAM

Suivez Intelligence-Artificielle

Sous la pression des besoins colossaux de l’IA, les prix de la DDR5 ont triplé depuis début 2025. Pour briser cette spirale inflationniste et optimiser des ressources devenues rares, les datacenters se tournent vers le protocole CXL (Compute Express Link). Cette technologie de mutualisation de la RAM promet de transformer la gestion des serveurs, passant d’une allocation rigide à un réservoir de mémoire partagé.

À titre d’information, la situation actuelle découle d’une aspiration massive des capacités de production par les géants Samsung, SK hynix et Micron

Ces derniers réorientent en effet leurs usines vers la mémoire HBM, indispensable aux GPU NVIDIA et AMD. Ce qui a comme impact l’assèchement de l’offre de DRAM conventionnelle. 

Et c’est cette tension qui a provoqué une hausse des prix de la DRAM de l’ordre de 93 % à 98 % pour le seul deuxième trimestre 2026.

Une répercussion également sur l’ensemble de la chaîne de valeur

Cette pression sur la production se répercute évidemment sur l’ensemble de la chaîne de valeur. 

Youtube video

Selon le patron de HP, la mémoire représente désormais 35 % du coût de fabrication d’un PC, contre environ 15 % l’année dernière. 

Dans le secteur de la mobilité, les prix des smartphones ont bondi de 40 % à 50 % selon les zones géographiques

Symbole de ce basculement du rapport de force, Apple a dû accepter une hausse tarifaire de 230 % pour sécuriser les composants de l’iPhone 17 sans pouvoir négocier face à des fournisseurs qui privilégient désormais les marges records de l’IA.

CXL est-il vraiment la seule solution à cette crise de la RAM ?

Le protocole Compute Express Link (CXL) s’impose comme la solution structurelle à cette crise. 

Utilisant les voies physiques du PCIe, il permet de regrouper la mémoire dans un pool partagé plutôt que de l’assigner fixement à chaque machine. 

L’évolution du standard témoigne d’ailleurs de cette urgence. C’est-à-dire que si la version 1.0 de 2019 se contentait d’étendre la mémoire via un slot PCIe, le CXL 2.0 a introduit la commutation et le pooling. Ce qui permet à plusieurs serveurs d’accéder à un réservoir commun. 

Aujourd’hui, le CXL 3.0 autorise un partage réel entre machines avec une cohérence de cache, tandis que la version 4.0, publiée fin 2025, consolide le soutien d’un consortium de 250 membres incluant Google, Meta et Microsoft

Actuellement, les processeurs AMD Epyc et Intel Xeon gèrent déjà la version 2.0, tandis qu’Amazon déploie le 3.0 sur ses puces Graviton5.

Le Memory Godboxes

Le marché de la RAM voit désormais l’émergence de châssis spécifiques, surnommés « Memory Godboxes » par The Register

Des acteurs comme Astera Labs, Marvell ou Enfabrica conçoivent des baies capables d’embarquer 18 To de DDR5 par châssis

NVIDIA a d’ailleurs racheté Enfabrica en septembre dernier pour coupler ces solutions aux racks Nvidia GB200, promettant une réduction de moitié des coûts de calcul. 

L’un des plus grands avantages des Memory Godboxes est l’offload des KV caches. Ce sont caches d’attention des modèles de langage qui occupent souvent un volume supérieur au modèle lui-même. 

En déportant ces caches vers des modules CXL de 128 à 256 Go fournis par Samsung ou Micron, les datacenters libèrent une bande passante critique pour l’IA générative.

Youtube video

Pas de normalisation des prix avant 2027

Si la mutualisation via CXL offre une bouffée d’oxygène aux infrastructures professionnelles, son effet sur le marché grand public ne sera pas immédiat

La pression sur la DDR5 devrait rester intense durant plusieurs trimestres, et les experts ne prévoient pas de normalisation des prix avant l’année 2027

D’ici là, le coût des composants mémoire restera le principal levier d’augmentation des prix des appareils électroniques pour le consommateur final.

Restez à la pointe de l'information avec
INTELLIGENCE-ARTIFICIELLE.COM !

Abonnez-vous à notre chaîne YouTube et rejoignez-nous sur Actualités

ARTICLES SIMILAIRES

OpenAI et Samsung unissent leurs forces pour développer les puces IA de demain

OpenAI et Samsung renforcent leur collaboration autour des puces IA destinées à accélérer le développement de l’intelligence artificielle. Les deux groupes souhaitent concevoir ensemble les

11 septembre 2026

La colocation de datacenter devient un pilier des infrastructures hybrides

Pour les différentes entreprises, la maîtrise des données reste centrale. Elles cherchent donc des infrastructures robustes, proches et évolutives. Face à l’essor des usages numériques,

1 septembre 2026

DuckDuckGo adopte GPT-5.6 Luna et alerte sur les risques d’illusion d’une IA trop confiante

DuckDuckGo innove en intégrant GPT-5.6 Luna à son offre d’intelligence artificielle. Cette initiative s’accompagne d’un avertissement majeur sur les illusions créées par une IA excessivement

27 août 2026

Fuite Gemini 3.5 Pro qui surpasse Claude Mythos 5 et qui rivalise avec GPT-6

Une fuite récente dévoile le potentiel impressionnant de Gemini 3.5 Pro, le nouveau modèle de Google. Il surpasse déjà Claude Mythos 5 et rivalise avec

26 août 2026

Muse Code, la technologie innonvante de Meta qui révolutionne vos projets créatifs

À l’heure où l’intelligence artificielle transforme radicalement les pratiques professionnelles, Muse Code se place comme un véritable catalyseur d’innovation. Cette nouvelle technologie innovante signée Meta

19 août 2026

Le scénario d’AI 2027 est-il en train de rattraper la réalité ?

Et si le scénario « AI 2027 » était en train de rattraper la réalité ? Publié en avril 2025 par l’AI Futures Project, ce

15 août 2026