Avec Broadcom, OpenAI a présenté les premiers résultats de référence pour sa propre puce d’inférence « Jalapeño » – et elle bat les systèmes NvidiaS Blackwell sur l’efficacité énergétique. Les chiffres ont été vérifiés indépendamment par l’entreprise d’analyse SemiAnalyse.
1,5 à 1,9 fois plus efficace
Sur trois modèles publics – GPT-OSS 120B, DeepSeek R1 670B et Moonshot Kimi K2.5 1T – Jalapeño livre 1,5 à 1,9 fois plus d’IA par watt que NvidiaS Blackwell (testé contre les systèmes GB200 et GB300), selon OpenAI. Sur la latence, la puce est même 1,7 à 3,6 fois devant. Il est optimisé spécifiquement pour l’inférence – les modèles d’IA en cours de production – et a été conçu en partie avec l’aide de l’IA. Il a été dévoilé à Hot Chips 2026.
Petits volumes au début
Le déploiement commence en « très petits volumes » à la fin de 2026, avec l’augmentation majeure prévue pour 2027. OpenAI souligne qu’il continuera à acheter du matériel Nvidia – sa propre puce est un complément, pas un remplacement immédiat.
Pour Nvidia la nouvelle est néanmoins gênante: de plus en plus de grands clients développent leur propre silicium, mettant la pression sur le leader du marché des marges élevées.
Sources : OpenAI, Matériel de Toms, CNBC.



















