OpenAI dévoile « Jalapeño », sa puce d’inférence, et mise sur une infrastructure IA intégrée
OpenAI présente « Jalapeño », sa première puce dédiée à l’inférence, dans le cadre d’une stratégie d’infrastructure IA intégrée
Le 25 août 2026, des médias et le blog officiel d’OpenAI ont publié des informations clés sur « The full stack behind abundant intelligence ». Sarah Friar, directrice financière (CFO) d’OpenAI, y détaille une approche technologique couvrant les puces, les modèles de pointe (Frontier Models), les plateformes pour développeurs et les produits grand public. Chaque couche renforce les autres afin de réduire les coûts, d’accroître la capacité et de rendre l’IA plus accessible.
L’annonce met notamment en avant « Jalapeño », la première puce d’inférence de l’entreprise. Selon des tests réalisés sur InferenceX, Jalapeño offre un débit par kilowatt supérieur et une latence par token inférieure à celle des systèmes commerciaux courants. Elle prend également en charge plusieurs familles de modèles, dont GPT-OSS 120B, DeepSeek R1 et Kimi K2.5, illustrant la volonté de l’entreprise de mieux maîtriser sa chaîne d’approvisionnement et ses performances de calcul.
En développant ses propres puces spécialisées comme Jalapeño, un leader de l’IA peut réduire ses coûts de calcul à long terme. Les services d’intelligence artificielle pourraient ainsi devenir moins chers et plus accessibles aux utilisateurs comme aux développeurs.