Puce IA Jalapeño : Le coup de maître d’OpenAI et Broadcom !

Suivez Intelligence-Artificielle

OpenAI vient d’annoncer les puces IA Jalapeño d’OpenAI. Il s’agit de son premier accélérateur IA co-développé avec Broadcom, conçu spécifiquement pour optimiser l’inférence des grands modèles de langage.

OpenAI et Broadcom ont présenté ensemble Jalapeño, un accélérateur IA pensé pour les grands modèles de langage (LLM). La puce constitue la première étape d’une plateforme de calcul multi-générationnelle. Elle illustre la volonté d’OpenAI de contrôler l’ensemble de sa pile technologique. Cette stratégie entre dans un contexte de courses à l’IA. Ce sprint pousseles grands acteurs de la technologie à concevoir leurs propres siliciums.

Une architecture repensée de zéro pour les LLM

Jalapeño n’est pas un accélérateur généraliste adapté à l’IA. Selon le communiqué conjoint d’OpenAI et Broadcom, la puce a été conçue intégralement de zéro, à partir d’une compréhension approfondie des fondamentaux des LLM. OpenAI a orienté l’architecture autour des noyaux, des mouvements de mémoire, des topologies réseau et des schémas de service propres aux modèles frontière.

Youtube video

L’architecture réduit les déplacements de données et équilibre les ressources de calcul, de mémoire et de réseau. Cela permet une utilisation réelle beaucoup plus proche du pic théorique, précise OpenAI. Les premiers tests menés en laboratoire incluent des charges de travail comme GPT‑5.3‑Codex‑Spark, à la fréquence et à la puissance cibles de production. En termes de performance par watt, les résultats préliminaires montrent une amélioration substantielle par rapport aux accélérateurs actuels, indique la société. Un rapport technique complet sera publié dans les prochains mois.

Comment Jalapeño a-t-il été développé en seulement neuf mois ?

Trois facteurs expliquent ce délai record : une co-conception logicielle et matérielle très étroite entre OpenAI et Broadcom, l’expertise en implémentation silicium de Broadcom, et l’utilisation des propres modèles IA d’OpenAI. Cela permet d’ accélérer certaines phases de conception, selon l’entreprise.

Du premier concept au tape-out de fabrication, neuf mois se sont donc écoulés. Selon OpenAI, il s’agit du cycle de développement ASIC le plus rapide jamais atteint dans les semi-conducteurs avancés haute performance. Sam Altman avait déjà plaidé pour produire des puces IA en interne bien avant que ce partenariat ne prenne forme. Si l’IA permet aux ingénieurs de concevoir de meilleures puces plus vite, elle peut ainsi faire baisser le coût du calcul à l’échelle de l’industrie, indique OpenAI.

Qui sont les partenaires industriels de Jalapeño ?

Deux partenaires industriels soutiennent le projet. Broadcom assure l’implémentation silicium et les technologies réseau, dont le silicium Tomahawk. Celestica prend en charge l’intégration des cartes, des racks et des systèmes de production à grande échelle.

Sam Altman et Greg Brockman ont reçu la puce des mains de Hock Tan et Charlie Kawwas, selon le communiqué officiel. Richard Ho, responsable du programme matériel d’OpenAI, précise que l’architecture a été optimisée autour des noyaux. Ils se sont aussi basés des mouvements mémoire et des topologies réseau les plus critiques pour les modèles frontières.

Un déploiement à grande échelle prévu avant fin 2026

Jalapeño constitue la première étape d’une plateforme multi-générationnelle dont le déploiement initial est prévu avant la fin de l’année 2026. Selon Hock Tan, PDG de Broadcom, des centres de données à l’échelle du gigawatt seront mis en service avec Microsoft. L’entreprise avait d’ailleurs envisagé plus tôt de fabriquer ses propres puces d’IA avant d’opter pour ce partenariat industriel avec Broadcom et Celestica.

À terme, les puces IA Jalapeño d’OpenAI visent à réduire les coûts d’inférence pour tous les profils d’utilisateurs. Chaque amélioration se traduit par une réponse plus rapide de ChatGPT, ainsi qu’une API moins onéreuse pour les développeurs. Cela offre aussi un accès plus stable lors des pics de demande, indique OpenAI. Greg Brockman résume l’objectif d’OpenAI : « Jalapeño fait partie de notre stratégie d’infrastructure full-stack à long terme pour rendre le calcul plus abondant, et l’IA plus rapide, plus fiable, plus accessible. »

Restez à la pointe de l'information avec
INTELLIGENCE-ARTIFICIELLE.COM !

Abonnez-vous à notre chaîne YouTube et rejoignez-nous sur Actualités

ARTICLES SIMILAIRES

« L’AGI est arrivée », la déclaration du patron de Nvidia qui fait débat et dont la communauté scientifique n’est pas d’accord

À la suite du lancement très remarqué du modèle GPT-6 Astra par OpenAI, le PDG de Nvidia, Jensen Huang, a officiellement proclamé que l’intelligence artificielle

8 septembre 2026

Open Spoken AI revendique une écriture intelligente libérée des filtres de discours

Open Spoken AI se présente comme un générateur de texte non censuré destiné aux marketeurs et aux auteurs. La plateforme revendique une liberté éditoriale que

7 septembre 2026

ElevenLabs : La référence du text-to-speech et du clonage vocal IA

Découvrez ElevenLabs, la référence mondiale du Text-to-Speech et du clonage vocal. Notre analyse décortique ses fonctionnalités, ses tarifs 2026 et ses performances concrètes. Le marché

4 septembre 2026

Avis Rytr.me : l’assistant IA de rédaction est-t-il pertinent en 2026 ?

Avis Rytr.me : l’assistant IA de rédaction est-t-il pertinent en 2026 ?

La plateforme Rytr.me aide plus de 8 millions de créateurs à accélérer leur rédaction web au quotidien. Cet assistant IA puissant génère vos contenus courts,

29 août 2026

Test de Descript : avis complet de l’outil IA hybride de sous-titrage et montage

Connaître les limites et les atouts d’une solution avant de s’engager est essentiel pour optimiser sa production vidéo. Si Submagic est le maître incontesté pour

28 août 2026

La nouvelle IA de Google supprime vos ‘euh’ et ‘hum’ dans les transcriptions

Google révolutionne la transcription audio avec une intelligence artificielle capable d’éliminer les hésitations vocales courantes. Cette avancée transforme l’expérience utilisateur en produisant des textes plus

27 août 2026