
NVIDIA apunta a 25% menos energía en entrenamiento con DSX y NVFP4
La compañía propone un stack completo para que las fábricas de IA optimicen tokens por watt, desde 45°C de refrigeración líquida hasta scheduling consciente de energía.
Todas las notas publicadas en MechaNoticias. Ordenadas por fecha de publicación, de la más reciente a la más antigua.
1.119 notas · Página 46 de 47

La compañía propone un stack completo para que las fábricas de IA optimicen tokens por watt, desde 45°C de refrigeración líquida hasta scheduling consciente de energía.

El modelo Flash ahora ve y opera navegadores, móviles y escritorios por sí solo, con 78,4 en OSWorld y a la par de GPT-5.5.

El modelo chino de Zhipu AI resuelve 66% de 103 tareas de programación contra el 67% de Anthropic, pero quema casi el doble de tokens y suma latencia con 99 iteraciones por tarea.

El reporte interno de OpenAI Economic Research detalla cómo el uso de Codex se profundizó entre noviembre de 2025 y junio de 2026 en investigación, soporte, ingeniería y legal.

Dos meses después del lanzamiento, el stack abierto pasó de 2.200 a 11.200 tok/s/GPU a la misma interactividad gracias a KV Compression V2, W4A4 MegaMoE y CUDA graphs rompibles en el prefill.

Anthropic estrena un agente que vive dentro de Slack, vigila canales sin ser invocado, etiqueta a compañeros responsables del código y dispara fixes cuando un A/B test cruza un guardrail.

Altman dijo a empleados que el modelo saldrá en preview limitado para empresas; el gobierno aprobará accesos caso a caso, condición más laxa que el ultimátum impuesto a Anthropic.

Datos de Indagari sobre 28 millones de tarjetahabientes muestran el avance del gasto en Anthropic; DataCamp reporta que la demanda de cursos de Claude triplica la de ChatGPT entre consumidores.

El nuevo soporte multi-device del runtime habilita paralelismo de tensor y de contexto, y los benchmarks colocan a DeepSpeed Ulysses como la mejor estrategia para diffusion con secuencias largas.

Google integra el control de navegador, móvil y escritorio al modelo principal Flash, y suma dos salvaguardas opcionales contra prompt injection pensadas para uso empresarial.

La operación paga 2,5 veces la valuación de hace nueve meses e integra a 150 ingenieros, incluido Chris Lattner (creador de LLVM y Swift), a la apuesta de Qualcomm por el centro de datos.

El robotaxi bidireccional de Amazon estrena interior verde aloe, asientos repadded y reflectores rotatorios mientras espera la exención del NHTSA para escalar producción en Hayward, California.

Henry Legg (Universidad de St Andrews) reanaliza los datos de Microsoft y concluye que la compañía no demostró de forma concluyente un qubit topológico funcional. Microsoft rechaza la objeción.

NVIDIA detalla cuatro cambios algorítmicos al pooling BEV que llevan la latencia de 274 µs a 16,4 µs en RTX PRO 6000 Blackwell Max-Q gracias a FP8 y mejor uso de caché L2.

El primer Intelligence Processor de OpenAI, fabricado con silicio de Broadcom, llega en despliegue a gran escala a fines de 2026 y Microsoft se comprometería a comprar el 40% de la producción inicial.

La nueva integración para Slack pone un único @Claude compartido por canal, con acceso a herramientas y código, y queda en beta para clientes Enterprise y Team corriendo sobre Opus 4.8.

La pila reúne modelos abiertos, blueprints y runtime seguro en un mismo stack para que empresas construyan agentes IA especializados sin depender de terceros.

En el DTW Ignite 2026 en Copenhague, la compañía muestra junto a Amdocs, ServiceNow, NTT DATA y TCS un runtime seguro (OpenShell) que orquesta agentes con políticas y sandboxing para redes 5G y 6G.

Junto a ALCHEMI y DAQIRI, la compañía presenta en ISC Hamburgo un trío de bibliotecas CUDA-X para astronomía, simulación de materiales y adquisición de datos.

La startup de IA presentó una tina de ultrasonido tipo spa que dice acercarse a un MRI, pero los expertos consultados por The Verge piden pruebas reales antes de cualquier comparación clínica.

El ranking de junio del ISC en Hamburgo muestra que 9 de cada 10 sistemas nuevos del TOP500 corren sobre tecnología Nvidia, con KAIROS liderando eficiencia a 73,3 gigaflops por watt.

El Agent Toolkit empaqueta OpenFold3, DiffDock, GenMol, Evo 2 y Parabricks como herramientas callable por agentes vía Model Context Protocol, sobre NIM hosted o local.

El tercer contrato GPU de SpaceX, ahora con Reflection AI, lleva sus rentas anuales a USD 28.000 millones según Jamin Ball: doble de la facturación actual de Coreweave.

El nuevo modelo lidera CyberGym (85,6%) y SEC-bench Pro (69,8%); el programa suma 25 partners como Cisco, CrowdStrike, Cloudflare y Palo Alto Networks.