
Groq 3 LPX: 3.431 tokens por segundo y nada de HBM
Nvidia presentó en Hot Chips 2026 la arquitectura del rack que heredó de Groq y publicó su primer benchmark de terceros, medido por Artificial Analysis sobre Gemma 4 31B.
5 notas publicadas

La compañía superó su propia proyección de 3X para este año, aunque la cifra es una estimación interna que combina mediciones reales con resultados modelados.

El chip, atribuido a Jeff Dean, grabaría el plano de Gemini en el hardware para ser 6 a 10 veces más eficiente que los TPU actuales. Google lo desplegaría desde 2028 para abaratar la inferencia.

La compañía contrató a Clive Chan, veterano de los equipos de silicio de Tesla y OpenAI, para armar un grupo interno de chips, aunque afirma que AWS, Google y NVIDIA seguirán siendo su base.

The Information reportó conversaciones exploratorias; Anthropic dice que sigue apostando por Google, Amazon y Nvidia en su stack de cómputo.
Otros temas que aparecen junto a #hardware ia en nuestra cobertura editorial.