
NVIDIA presenta RoboLab para evaluar robots de forma justa
La plataforma de NVIDIA Research busca resolver uno de los problemas sin resolver de la robótica: cómo medir de verdad si una política de control funcionará fuera del laboratorio.
Todas las notas publicadas en MechaNoticias. Ordenadas por fecha de publicación, de la más reciente a la más antigua.
1.130 notas · Página 37 de 48

La plataforma de NVIDIA Research busca resolver uno de los problemas sin resolver de la robótica: cómo medir de verdad si una política de control funcionará fuera del laboratorio.

El proyecto AgenticSTS reemplaza el registro de chat que crece sin fin por cinco capas de memoria ordenada, y en el proceso recorta el gasto de tokens hasta 90 veces.

Con el protocolo del GamePad ya sometido a ingeniería inversa, un tablet Windows de 2007 casi se convierte en control de Wii U, hasta que su CPU de 900 MHz dice basta.

El modelo de 8B guía robots por entornos desconocidos usando una sola cámara RGB y, según la empresa, supera a los sistemas con sensores de profundidad o varias cámaras.

El modelo empata en el Intelligence Index de Artificial Analysis, gana el duelo de programación y llega con un costo por tarea más bajo que sus rivales directos.

Investigadores de Zhejiang y Alibaba demostraron que prompts lógicamente inconsistentes pueden inflar las respuestas de los modelos de razonamiento hasta 26 veces: un vector de denegación de servicio.

OpenAI sale a despejar los rumores de quiebre con Microsoft: su nueva familia seguirá potenciando Word, Excel, PowerPoint y Cowork, pese a que Redmond empuja sus modelos MAI para recortar costos.

NVIDIA reemplazó la comunicación por MPI orquestada desde la CPU con acceso directo entre GPUs vía NVSHMEM, y logró hasta el doble de rendimiento en los clústeres Eos y GB200 NVL72.

Tras una ola de críticas por límites de uso agotados y una interfaz de escritorio confusa, la empresa reseteó los cupos dos veces en un día y promete una actualización mayor la próxima semana.

Un pipeline iterativo con NeMo Data Designer, NeMo Curator y modelos Nemotron produjo 502.536 titulares únicos en 82 rondas sobre un solo nodo B200, para entrenar modelos de IA financiera.

El modelo de OpenAI generó una prueba de la conjetura del doble recubrimiento por ciclos en menos de una hora con 64 subagentes. Un matemático la valida, pero critica la falta de citas.

El desarrollador Fabian Kubler dejó que el modelo Fable 5 de Anthropic escribiera y probara casi todo el port, que aprueba 430 de 468 tests del núcleo de MicroPython.

La Academia de IA de Pekín entrenó Orca con 125.000 horas de video sin una sola etiqueta de acción y aun así iguala al sistema especializado π0.5 en cinco tareas de robótica.

El modelo de xAI queda detrás de Fable 5 y GPT-5.5 en varios benchmarks de programación, pero cuesta 2 dólares por millón de tokens de entrada y usa 4,2 veces menos tokens que Opus 4.8.

La compañía fabricará su acelerador propio con Broadcom y TSMC para reducir su dependencia de las GPU de Nvidia y AMD, en plena escasez de componentes.

El modelo multimodal para programación agéntica cuesta 1,25 dólares por millón de tokens de entrada y llega tarde frente a OpenAI y Anthropic, pero apuesta por el precio bajo.

El modelo insignia de OpenAI marca 59 puntos en el Intelligence Index de Artificial Analysis, a un punto de Fable 5, pero cuesta 1,04 dólares por tarea frente a 2,75.

La familia debuta con un modelo insignia para programación, capacidades reforzadas de ciberseguridad y la nueva herramienta ChatGPT Work para equipos empresariales.

El resumen semanal de IEEE Spectrum trae el primer fútbol 11 vs 11 entre humanoides, manos con 25 grados de libertad y un modelo que domina tareas físicas con una hora de datos.

Ingenieros de Meta muestran cómo fundir operaciones de normalización como LayerNorm y RMSNorm dentro de los kernels GEMM y de atención para ocultar hasta el 90% de su latencia en GPU B200.

Una guía técnica de NVIDIA explica por qué la forma de un modelo (capas cuadradas, dimensiones múltiplos de 128 y más ancho que profundo) define cuánto rendimiento se saca de una GPU Blackwell.

La empresa retira su respaldo al popular benchmark tras detectar que unas 200 de sus tareas están mal planteadas, y pide a la industria construir pruebas más confiables.

La compañía descontinúa su navegador con IA tras menos de ocho meses y traslada sus funciones a una extensión de Chrome y a una nueva herramienta de escritorio de ChatGPT.

El host offloading libera memoria HBM al mover activaciones a la RAM del sistema, con hasta 57% más rendimiento al entrenar modelos como DeepSeek-V3 671B en NVIDIA Grace Blackwell.