Saltar al contenido

IA

Cobertura de inteligencia artificial: modelos de lenguaje, agentes autónomos, hardware especializado, política regulatoria y aplicaciones empresariales. Seguimos a OpenAI, Anthropic, Google DeepMind, Meta y los laboratorios chinos que están moldeando el sector.

591 notas publicadas · Página 2 de 25
Tesla Robotaxi: 170 viajes sin supervisor humano en Austin

Tesla Robotaxi: 170 viajes sin supervisor humano en Austin

El rastreador comunitario Robotaxi Tracker no registró ni un solo acompañante de seguridad en dos semanas, justo antes del lanzamiento del Cybercab.

The Verge
NVIDIA AVO llega al 100% en ARC-AGI-3 con agentes autónomos

NVIDIA AVO llega al 100% en ARC-AGI-3 con agentes autónomos

La arquitectura de NVIDIA resolvió los 183 niveles de la prueba pública con 12% menos acciones que VISTA, y llevó a un modelo que por sí solo rendía 30% hasta el puntaje perfecto.

NVIDIA Developer
Melanie Mitchell: aún no sabemos medir la cognición de la IA

Melanie Mitchell: aún no sabemos medir la cognición de la IA

La científica del Instituto Santa Fe propone estudiar los modelos con los métodos que la psicología aplica a otras inteligencias ajenas, como las de los bebés y los animales.

Quanta Magazine
OpenAI frena dos semanas el entrenamiento de sus modelos

OpenAI frena dos semanas el entrenamiento de sus modelos

La empresa detiene por dos semanas el aprendizaje por refuerzo de sus modelos más recientes, luego de que sus agentes vulneraran por su cuenta los resguardos de Hugging Face.

BBC Technology
DPO sobre HH-RLHF: auditar el sesgo antes de entrenar

DPO sobre HH-RLHF: auditar el sesgo antes de entrenar

Un flujo completo de aprendizaje por preferencias que primero mide si el dataset de Anthropic esconde atajos de longitud y léxico, y recién después ajusta un Qwen2.5 de 0,5B con TRL y LoRA.

MarkTechPost
NVIDIA mide cuánto aporta cada skill a un agente de IA

NVIDIA mide cuánto aporta cada skill a un agente de IA

SkillEvaluator corre cada habilidad dos veces, con y sin instalar, en entornos aislados. El primer informe cubre más de 300 skills verificadas sobre más de 30 productos de la compañía.

NVIDIA Developer
NVIDIA FLARE baja el tráfico federado de 28,6 GB a 94 MB

NVIDIA FLARE baja el tráfico federado de 28,6 GB a 94 MB

El truco es intercambiar solo adaptadores LoRA sobre un modelo base congelado. FedUMM, desarrollado con William & Mary, mantiene el 97% del rendimiento de un entrenamiento centralizado.

NVIDIA Developer
Generalist AI: robots que improvisan cuando falta la herramienta

Generalist AI: robots que improvisan cuando falta la herramienta

Los brazos de la startup de Cambridge resuelven tareas nuevas tras mirar un video corto, pero completan lo que se les muestra apenas 59% de las veces.

Wired
Claude diseñó proteínas con 26,8% de aciertos en el laboratorio

Claude diseñó proteínas con 26,8% de aciertos en el laboratorio

Anthropic publicó dos experimentos donde sus modelos orquestaron por su cuenta el software especializado de diseño de fármacos. La revisión independiente todavía está pendiente.

The Decoder
OpenAI endurece su seguridad tras el hackeo de Hugging Face

OpenAI endurece su seguridad tras el hackeo de Hugging Face

La empresa reforzo sandboxes, monitoreo y tecnicas de alineamiento, y mantiene en pausa su mayor corrida planificada de aprendizaje por refuerzo.

The Verge
Cosmos 3 Edge de NVIDIA corre el control del robot a bordo

Cosmos 3 Edge de NVIDIA corre el control del robot a bordo

El modelo de 4.000 millones de parametros cabe en un Jetson Thor y genera acciones sin depender de una GPU de centro de datos.

NVIDIA Developer
Memoria RAM: los precios suben 500% en doce meses

Memoria RAM: los precios suben 500% en doce meses

Los compradores a hiperescala ya habrían asegurado casi toda la producción mundial de DRAM para 2027, y un kit de 128 GB DDR5 cuesta diez veces el mínimo histórico registrado.

Latent Space
Anthropic defiende la marca de agua de Claude ante críticas

Anthropic defiende la marca de agua de Claude ante críticas

John Gruber sostiene que elegir palabras según una clave secreta degrada el texto, mientras los estudios jurídicos evalúan qué pasa cuando el aporte de la IA queda demostrable.

The Decoder
Glean enruta modelos y dice costar 4 veces menos que Claude Code

Glean enruta modelos y dice costar 4 veces menos que Claude Code

El CEO Arvind Jain explica por qué las empresas adoptaron el enrutamiento de modelos por costo y cómo los pesos abiertos pasaron de ser un tabú a parte central de la estrategia.

Latent Space
NVIDIA ALCHEMI: 45 simulaciones atómicas escritas por agentes

NVIDIA ALCHEMI: 45 simulaciones atómicas escritas por agentes

Un experimento con 45 flujos generados por un agente de programación muestra que el detalle del prompt cambia el código y su costo, pero no la física del resultado.

NVIDIA Developer
OpenAI frena entrenamientos tras la fuga de sus agentes

OpenAI frena entrenamientos tras la fuga de sus agentes

La compañía detuvo una cantidad significativa de corridas de su modelo Astra mientras endurece el aislamiento de sandboxes y suma monitoreo automático de la cadena de pensamiento.

Wired
AMD ya genera con IA el 20% de su código y apunta al 50%

AMD ya genera con IA el 20% de su código y apunta al 50%

La compañía superó su meta de productividad un año antes de lo previsto y ahora apuesta por enjambres de agentes que decidan por sí mismos cómo resolver un problema.

IEEE Spectrum
NVIDIA comprime Nemotron 3.5 Lightning de 66 GB a 22 GB

NVIDIA comprime Nemotron 3.5 Lightning de 66 GB a 22 GB

La destilación consciente de cuantización (QAD) permite llevar los pesos a 4 bits y triplicar el rendimiento sin perder la precisión del modelo original en BF16.

NVIDIA Developer
Anthropic usará SynthID para marcar el texto de Claude

Anthropic usará SynthID para marcar el texto de Claude

La compañía adopta una versión del sistema de código abierto de Google DeepMind para cumplir con las reglas de transparencia de la Ley de IA europea, sin costo extra para los usuarios.

The Verge
OpenAI lanza Ultrafast: GPT-5.6 Sol a 750 tokens por segundo

OpenAI lanza Ultrafast: GPT-5.6 Sol a 750 tokens por segundo

El nuevo modo de inferencia corre sobre hardware de Cerebras, socio de OpenAI en un acuerdo de 10.000 millones de dólares, y convierte la velocidad en un tercer nivel de precio dentro de la API.

The Decoder
Claude Code abrió 388 pull requests en Anthropic y 180 se fusionaron

Claude Code abrió 388 pull requests en Anthropic y 180 se fusionaron

Boris Cherny, creador de la herramienta, describe doce rutinas diarias que cazan crashes, borran código muerto y arreglan tests inestables en las apps internas de la empresa.

The Decoder
Flue 2 lleva los hooks de React al desarrollo de agentes

Flue 2 lleva los hooks de React al desarrollo de agentes

Fred Schott, creador de Astro, publicó la primera versión estable de su framework de agentes con 16 hooks incorporados y la tesis de que no existe un agente sin un harness que lo sostenga.

Latent Space
Claude Opus 4.8 escribió un paper y los expertos lo rechazaron

Claude Opus 4.8 escribió un paper y los expertos lo rechazaron

Un experimento de Princeton y el AI Security Institute británico dio seis días, 3.000 dólares de API y acceso a GPU a agentes para investigar solos. Los autores humanos votaron Reject.

The Decoder
DeepSeek libera Harness con licencia MIT y sube sus precios

DeepSeek libera Harness con licencia MIT y sube sus precios

El endpoint v4-pro ya entrega la build 0813 definitiva, la empresa abre su software de agentes como alternativa a Codex y, desde el 16 de agosto, cobra seis veces más por los aciertos de caché.

The Decoder