
Jalapeño: el primer chip de OpenAI rinde 1,9 veces por watt
La compañía midió su acelerador de inferencia contra sistemas comerciales en tres modelos de pesos abiertos y reporta hasta 4,1 veces más rendimiento en las cargas más interactivas.
6 notas publicadas

OpenAI detalló en Hot Chips la arquitectura NUMA de su acelerador de inferencia: 216 GB de HBM4, dos redes internas separadas y más de la mitad del núcleo escrita con ayuda de sus propios modelos.

El primer acelerador propio de OpenAI, hecho con Broadcom, se llevó los mejores números de rendimiento por watt en el banco de pruebas InferenceX, aunque no pasa de muestras de ingeniería.

OpenAI mostró en Hot Chips su acelerador desarrollado con Broadcom, pensado solo para inferencia, con producción en volumen prevista para 2027.

El ASIC diseñado a medida para inferencia llega nueve meses después del anuncio de la sociedad y promete rendimiento por watt mayor al estado del arte actual, según OpenAI.

El primer Intelligence Processor de OpenAI, fabricado con silicio de Broadcom, llega en despliegue a gran escala a fines de 2026 y Microsoft se comprometería a comprar el 40% de la producción inicial.
Otros temas que aparecen junto a #jalapeno en nuestra cobertura editorial.