OpenAI vient d’annoncer les puces IA Jalapeño d’OpenAI. Il s’agit de son premier accélérateur IA co-développé avec Broadcom, conçu spécifiquement pour optimiser l’inférence des grands modèles de langage.
OpenAI et Broadcom ont présenté ensemble Jalapeño, un accélérateur IA pensé pour les grands modèles de langage (LLM). La puce constitue la première étape d’une plateforme de calcul multi-générationnelle. Elle illustre la volonté d’OpenAI de contrôler l’ensemble de sa pile technologique. Cette stratégie entre dans un contexte de courses à l’IA. Ce sprint pousseles grands acteurs de la technologie à concevoir leurs propres siliciums.
Une architecture repensée de zéro pour les LLM
Jalapeño n’est pas un accélérateur généraliste adapté à l’IA. Selon le communiqué conjoint d’OpenAI et Broadcom, la puce a été conçue intégralement de zéro, à partir d’une compréhension approfondie des fondamentaux des LLM. OpenAI a orienté l’architecture autour des noyaux, des mouvements de mémoire, des topologies réseau et des schémas de service propres aux modèles frontière.
L’architecture réduit les déplacements de données et équilibre les ressources de calcul, de mémoire et de réseau. Cela permet une utilisation réelle beaucoup plus proche du pic théorique, précise OpenAI. Les premiers tests menés en laboratoire incluent des charges de travail comme GPT‑5.3‑Codex‑Spark, à la fréquence et à la puissance cibles de production. En termes de performance par watt, les résultats préliminaires montrent une amélioration substantielle par rapport aux accélérateurs actuels, indique la société. Un rapport technique complet sera publié dans les prochains mois.
Comment Jalapeño a-t-il été développé en seulement neuf mois ?
Trois facteurs expliquent ce délai record : une co-conception logicielle et matérielle très étroite entre OpenAI et Broadcom, l’expertise en implémentation silicium de Broadcom, et l’utilisation des propres modèles IA d’OpenAI. Cela permet d’ accélérer certaines phases de conception, selon l’entreprise.
We’ve designed and built our first AI chip: Jalapeño.
— OpenAI (@OpenAI) June 24, 2026
Designed from the ground up by OpenAI and brought to production with @Broadcom, Jalapeño is purpose-built for the LLM workloads powering ChatGPT, Codex, the API, and future agentic products.
Chips are foundational to the AI… pic.twitter.com/mHU7DaMMTi
Du premier concept au tape-out de fabrication, neuf mois se sont donc écoulés. Selon OpenAI, il s’agit du cycle de développement ASIC le plus rapide jamais atteint dans les semi-conducteurs avancés haute performance. Sam Altman avait déjà plaidé pour produire des puces IA en interne bien avant que ce partenariat ne prenne forme. Si l’IA permet aux ingénieurs de concevoir de meilleures puces plus vite, elle peut ainsi faire baisser le coût du calcul à l’échelle de l’industrie, indique OpenAI.
Qui sont les partenaires industriels de Jalapeño ?
Deux partenaires industriels soutiennent le projet. Broadcom assure l’implémentation silicium et les technologies réseau, dont le silicium Tomahawk. Celestica prend en charge l’intégration des cartes, des racks et des systèmes de production à grande échelle.
Sam Altman et Greg Brockman ont reçu la puce des mains de Hock Tan et Charlie Kawwas, selon le communiqué officiel. Richard Ho, responsable du programme matériel d’OpenAI, précise que l’architecture a été optimisée autour des noyaux. Ils se sont aussi basés des mouvements mémoire et des topologies réseau les plus critiques pour les modèles frontières.
Un déploiement à grande échelle prévu avant fin 2026
Jalapeño constitue la première étape d’une plateforme multi-générationnelle dont le déploiement initial est prévu avant la fin de l’année 2026. Selon Hock Tan, PDG de Broadcom, des centres de données à l’échelle du gigawatt seront mis en service avec Microsoft. L’entreprise avait d’ailleurs envisagé plus tôt de fabriquer ses propres puces d’IA avant d’opter pour ce partenariat industriel avec Broadcom et Celestica.
À terme, les puces IA Jalapeño d’OpenAI visent à réduire les coûts d’inférence pour tous les profils d’utilisateurs. Chaque amélioration se traduit par une réponse plus rapide de ChatGPT, ainsi qu’une API moins onéreuse pour les développeurs. Cela offre aussi un accès plus stable lors des pics de demande, indique OpenAI. Greg Brockman résume l’objectif d’OpenAI : « Jalapeño fait partie de notre stratégie d’infrastructure full-stack à long terme pour rendre le calcul plus abondant, et l’IA plus rapide, plus fiable, plus accessible. »
- Partager l'article :
Restez à la pointe de l'information avec
INTELLIGENCE-ARTIFICIELLE.COM !
