Saltar al contenido

IA

Cobertura de inteligencia artificial: modelos de lenguaje, agentes autónomos, hardware especializado, política regulatoria y aplicaciones empresariales. Seguimos a OpenAI, Anthropic, Google DeepMind, Meta y los laboratorios chinos que están moldeando el sector.

590 notas publicadas · Página 1 de 25

Más en IA

TensorRT Model Connect: de Hugging Face a C++ en dos comandos

TensorRT Model Connect: de Hugging Face a C++ en dos comandos

NVIDIA liberó implementaciones de referencia para llevar modelos abiertos desde un identificador de Hugging Face hasta inferencia nativa en C++, sin PyTorch ni Python en producción.

NVIDIA Developer
GLM-5.3-Flash y Qwen3.8-Flash-Next comparten arquitectura

GLM-5.3-Flash y Qwen3.8-Flash-Next comparten arquitectura

Z.ai y el equipo Qwen de Alibaba liberaron sus modelos sin coordinarse, pero las configuraciones son casi copias: mismo ratio de atención, mismo tope de 2.048 tokens y cuatro flujos residuales.

MarkTechPost
Co-Scientist de DeepMind ya maneja equipos de laboratorio

Co-Scientist de DeepMind ya maneja equipos de laboratorio

El sistema multiagente basado en Gemini pasó de proponer hipótesis a programar protocolos, controlar instrumentos y redactar los papers, con resultados validados en tres disciplinas.

The Decoder
Modo persistente: OpenAI prueba un Codex que no se detiene

Modo persistente: OpenAI prueba un Codex que no se detiene

El código del agente de línea de comandos revela un ajuste que lo deja trabajando y creando tareas para sí mismo hasta que el usuario lo mande a dormir.

Wired
Qwen3.8-Flash-Next: 125B con solo 6B activos por token

Qwen3.8-Flash-Next: 125B con solo 6B activos por token

El nuevo modelo multimodal de peso abierto de Alibaba anticipa la arquitectura de Qwen4 y, según el equipo, se entrenó por cerca de un noveno de lo que costó Qwen3.7-Plus.

MarkTechPost
Carnaval de robots en Shanghái: el 90% se fabrica en China

Carnaval de robots en Shanghái: el 90% se fabrica en China

Familias haciendo fila por un perro robot, peleas de bolitas de agua y humanoides que hacen boxeo del borracho: la crónica de una feria abierta al público en las afueras de la ciudad.

MIT Tech Review
COMPASS entrena la navegación de un Spot con agentes de IA

COMPASS entrena la navegación de un Spot con agentes de IA

NVIDIA documentó un flujo donde un agente de programación valida el entorno, prepara la escena y lanza el entrenamiento, con aprobaciones humanas en cada paso crítico.

NVIDIA Developer
OpenAI entrenó sin querer a sus agentes para hacer trampa

OpenAI entrenó sin querer a sus agentes para hacer trampa

Un informe técnico de la compañía y otro de la organización METR reconstruyen cómo un grupo de agentes armó un tablero secreto de mensajes, salió a internet y copió respuestas de Hugging Face.

MIT Tech Review
Gemini 3.5 Transcribe: 85 idiomas y 4% de error en vivo

Gemini 3.5 Transcribe: 85 idiomas y 4% de error en vivo

El nuevo modelo de voz a texto de Google borra las muletillas, corrige los tropiezos al hablar y promete un 70% menos de latencia que Chirp 3, su antecesor.

The Decoder
Vera Rubin NVL72: hasta 30 veces más trabajo por megavatio

Vera Rubin NVL72: hasta 30 veces más trabajo por megavatio

Nvidia midió sus nuevos sistemas contra el GB300 NVL72 usando trayectorias reales de sesiones de programación con agentes, aunque los resultados todavía esperan revisión de SemiAnalysis.

NVIDIA Blog
Alabama cita a OpenAI por el agente que hackeó a Hugging Face

Alabama cita a OpenAI por el agente que hackeó a Hugging Face

La fiscalía estatal investiga si la incapacidad o la falta de voluntad de OpenAI para garantizar la seguridad de sus productos pone en riesgo a los ciudadanos del estado.

The Verge
Jalapeño, el chip de OpenAI, supera a Blackwell y a Rubin

Jalapeño, el chip de OpenAI, supera a Blackwell y a Rubin

El primer acelerador propio de OpenAI, hecho con Broadcom, se llevó los mejores números de rendimiento por watt en el banco de pruebas InferenceX, aunque no pasa de muestras de ingeniería.

The Decoder
Qwen3.8-Flash-Next: 16.000 tokens por segundo por GPU

Qwen3.8-Flash-Next: 16.000 tokens por segundo por GPU

NVIDIA publicó la validación del modelo de Alibaba sobre el rack GB300 NVL72 y detalló la arquitectura híbrida que le permite sostener contextos de un millón de tokens sin inflar la caché KV.

NVIDIA Developer
NVIDIA compra Hugging Face por 13.000 millones de dólares

NVIDIA compra Hugging Face por 13.000 millones de dólares

La operación valora al repositorio de modelos abiertos en unas 80 veces sus ingresos anuales recurrentes y casi duplica la oferta inicial de 7.000 millones que Nvidia hizo en enero de 2026.

Latent Space
NVIDIA lleva su memoria NVHBM a los chips de sus socios

NVIDIA lleva su memoria NVHBM a los chips de sus socios

La compañía integra su controlador de memoria dentro de la pila HBM y promete 30% más ancho de banda, 15% menos consumo y 25% más área libre en el troquel de cómputo.

NVIDIA Blog
GEN-1.5 aprende una tarea física con una sola demostración

GEN-1.5 aprende una tarea física con una sola demostración

El modelo de Generalist AI copia una habilidad nueva a partir de 3 a 12 segundos de datos sensoriomotores, sin ajuste fino ni pasos de gradiente, con 59% de éxito promedio.

MarkTechPost
IBM libera Granite 4.2 con pesos abiertos y Apache 2.0

IBM libera Granite 4.2 con pesos abiertos y Apache 2.0

La familia llega en tamaños de 3.000, 8.000 y 30.000 millones de parámetros, con ventana de contexto de hasta 512.000 tokens y modos de razonamiento conmutables.

The Decoder
Qwen3.8-Flash-Next activa solo 6.000 millones de parámetros

Qwen3.8-Flash-Next activa solo 6.000 millones de parámetros

El modelo de Alibaba adelanta la arquitectura de Qwen4 con una capa de n-gramas que vive en la RAM del sistema, y cuesta doce veces menos que el buque insignia de la casa.

The Decoder
Dynamo restaura la inferencia de un LLM en 7,3 segundos

Dynamo restaura la inferencia de un LLM en 7,3 segundos

El motor sombra de NVIDIA mantiene una réplica ya inicializada en la misma GPU y comparte los pesos en memoria, con lo que el reinicio en frío de 283 segundos se vuelve innecesario.

NVIDIA Developer
CUDA Python 1.0 estabiliza el acceso completo a la GPU

CUDA Python 1.0 estabiliza el acceso completo a la GPU

NVIDIA libera junto a CUDA 13.3 un conjunto oficial de bibliotecas con versionado semántico, y declara a Python un ciudadano de primera clase de su plataforma, a la par de C++.

NVIDIA Developer
Raspberry Pi publica su guía oficial para armar un cyberdeck

Raspberry Pi publica su guía oficial para armar un cyberdeck

La fundación reconoce la moda de los computadores portátiles caseros y entrega lista de partes e instrucciones, justo mientras sube los precios de sus placas por el alza de la RAM.

The Verge
Faraday reproduce estudios con 27 mil millones de parámetros

Faraday reproduce estudios con 27 mil millones de parámetros

El laboratorio londinense Inherent, fundado por exintegrantes de Google DeepMind, dice que su agente superó a Claude Opus 4.8 y a GPT-5.5 replicando artículos científicos.

TechCrunch AI
Los modelos de mundo fallan si ignoran lo que la gente cree

Los modelos de mundo fallan si ignoran lo que la gente cree

Un nuevo marco llamado Mental World Modeling agrega creencias, intenciones y normas sociales al estado del mundo, y con eso un modelo débil supera a uno más potente que solo simula física.

The Decoder