Saltar al contenido
Etiqueta

#blackwell

12 notas publicadas

NVIDIA: diseñar modelos de IA pensados para la GPU
IA

NVIDIA: diseñar modelos de IA pensados para la GPU

Una guía técnica de NVIDIA explica por qué la forma de un modelo (capas cuadradas, dimensiones múltiplos de 128 y más ancho que profundo) define cuánto rendimiento se saca de una GPU Blackwell.

NVIDIA Developer
JAX descarga activaciones al host y sube 57% el rendimiento
IA

JAX descarga activaciones al host y sube 57% el rendimiento

El host offloading libera memoria HBM al mover activaciones a la RAM del sistema, con hasta 57% más rendimiento al entrenar modelos como DeepSeek-V3 671B en NVIDIA Grace Blackwell.

NVIDIA Developer
NVIDIA NTP mantiene el entrenamiento LLM si caen GPUs
IA

NVIDIA NTP mantiene el entrenamiento LLM si caen GPUs

Nonuniform Tensor Parallelism reconfigura el paralelismo tensorial en caliente cuando una GPU falla dentro de un dominio NVLink, con overhead bajo 1%.

NVIDIA Developer
NVIDIA Confidential Computing rinde 98% del baseline sin cifrar
IA

NVIDIA Confidential Computing rinde 98% del baseline sin cifrar

El benchmark en HGX B300 con Qwen 3.5-397B-A17B-FP8 muestra menos del 8% de overhead con Confidential Computing activado.

NVIDIA Developer
NVIDIA GQE: motor SQL 7,5x más rápido en GPUs Blackwell
IA

NVIDIA GQE: motor SQL 7,5x más rápido en GPUs Blackwell

La arquitectura GPU Query Engine descarga la descompresión al bloque dedicado del Blackwell y aprovecha HBM y NVLink-C2C para acelerar consultas SQL sobre grandes volúmenes de datos.

NVIDIA Developer
NVIDIA baja hasta 5x el costo por token de DeepSeek V4 en Blackwell
IA

NVIDIA baja hasta 5x el costo por token de DeepSeek V4 en Blackwell

El stack full-stack de inferencia sobre GB300 combina Dynamo, TensorRT-LLM, NVFP4 y NVLink para multiplicar por 20 el throughput por GPU y desplomar el costo por token.

NVIDIA Blog
Claude corre en NVIDIA GB300 Blackwell Ultra desde Azure Foundry
IA

Claude corre en NVIDIA GB300 Blackwell Ultra desde Azure Foundry

Anthropic, Microsoft y NVIDIA declaran la disponibilidad general de Claude sobre GPUs Blackwell Ultra y redes Quantum-X800 InfiniBand en Microsoft Foundry para agentes empresariales.

NVIDIA Blog
NVIDIA cuantiza Nemotron 3 Ultra a NVFP4 con 5,9x más throughput
IA

NVIDIA cuantiza Nemotron 3 Ultra a NVFP4 con 5,9x más throughput

El equipo de NVIDIA reduce el checkpoint del modelo de 550B desde 1.121 GB en BF16 a 352 GB en NVFP4, con la técnica four-over-six que recupera 98,5% de la precisión sobre Blackwell.

NVIDIA Developer
AWS EC2 G7 estrena Blackwell con 4.6x más inferencia que G6
IA

AWS EC2 G7 estrena Blackwell con 4.6x más inferencia que G6

Las nuevas instancias suman hasta 8 RTX PRO 4500 Blackwell, 256 GB de memoria GPU y 700 Gbps en EFA, y NVIDIA cuVS pasa a default en OpenSearch Serverless.

NVIDIA Blog
SpaceX renta GPUs por USD 28.000M, doble que Coreweave
IA

SpaceX renta GPUs por USD 28.000M, doble que Coreweave

El tercer contrato GPU de SpaceX, ahora con Reflection AI, lleva sus rentas anuales a USD 28.000 millones según Jamin Ball: doble de la facturación actual de Coreweave.

Latent Space
DFlash: hasta 15x más inferencia LLM en NVIDIA Blackwell
IA

DFlash: hasta 15x más inferencia LLM en NVIDIA Blackwell

El método de speculative decoding por bloques desplaza a EAGLE-3 y libera 20 checkpoints abiertos en Hugging Face para Hopper y Blackwell.

NVIDIA Developer

Etiquetas relacionadas

Otros temas que aparecen junto a #blackwell en nuestra cobertura editorial.