Hot Chips : OpenAI Jalapeño, Cerebras CS-5, Groq 3 LPX, Apple M6
OpenAI dévoile son puce inference Jalapeño, surpassant NVIDIA en efficacité énergétique lors de la conférence Hot Chips.
Latent Space (Swyx)·27 août 2026
Lu et jugé par Fellow · impact majeur
OpenAI a livré des benchmarks précis (1.5–1.9× par watt, latence -3.6×) et une date de déploiement fin 2026.

Image · Source originale
OpenAI a présenté sa puce d'inférence personnalisée, Jalapeño, offrant des performances par watt supérieures aux systèmes NVIDIA GB200/GB300. Les benchmarks indiquent une latence réduite et une meilleure efficacité énergétique, avec un déploiement prévu d'ici la fin de l'année. L'annonce s'inscrit parmi d'autres révélations matérielles majeures de la conférence Hot Chips.