Saltar al contenido
Etiqueta

#llm

60 notas publicadas

Co-Scientist de DeepMind ya maneja equipos de laboratorio
IA

Co-Scientist de DeepMind ya maneja equipos de laboratorio

El sistema multiagente basado en Gemini pasó de proponer hipótesis a programar protocolos, controlar instrumentos y redactar los papers, con resultados validados en tres disciplinas.

The Decoder
Qwen3.8-Flash-Next: 125B con solo 6B activos por token
IA

Qwen3.8-Flash-Next: 125B con solo 6B activos por token

El nuevo modelo multimodal de peso abierto de Alibaba anticipa la arquitectura de Qwen4 y, según el equipo, se entrenó por cerca de un noveno de lo que costó Qwen3.7-Plus.

MarkTechPost
GitHub explica cómo evaluar un LLM antes de producción
Open Source

GitHub explica cómo evaluar un LLM antes de producción

El equipo detrás del escaneo de secretos comparte seis prácticas para pasar de un prototipo prometedor a un sistema desplegado, con la métrica de seguridad como restricción y no como promedio.

GitHub Blog
Gemini 3.5 Transcribe: 85 idiomas y 4% de error en vivo
IA

Gemini 3.5 Transcribe: 85 idiomas y 4% de error en vivo

El nuevo modelo de voz a texto de Google borra las muletillas, corrige los tropiezos al hablar y promete un 70% menos de latencia que Chirp 3, su antecesor.

The Decoder
Qwen3.8-Flash-Next: 16.000 tokens por segundo por GPU
IA

Qwen3.8-Flash-Next: 16.000 tokens por segundo por GPU

NVIDIA publicó la validación del modelo de Alibaba sobre el rack GB300 NVL72 y detalló la arquitectura híbrida que le permite sostener contextos de un millón de tokens sin inflar la caché KV.

NVIDIA Developer
IBM libera Granite 4.2 con pesos abiertos y Apache 2.0
IA

IBM libera Granite 4.2 con pesos abiertos y Apache 2.0

La familia llega en tamaños de 3.000, 8.000 y 30.000 millones de parámetros, con ventana de contexto de hasta 512.000 tokens y modos de razonamiento conmutables.

The Decoder
Qwen3.8-Flash-Next activa solo 6.000 millones de parámetros
IA

Qwen3.8-Flash-Next activa solo 6.000 millones de parámetros

El modelo de Alibaba adelanta la arquitectura de Qwen4 con una capa de n-gramas que vive en la RAM del sistema, y cuesta doce veces menos que el buque insignia de la casa.

The Decoder
Dynamo restaura la inferencia de un LLM en 7,3 segundos
IA

Dynamo restaura la inferencia de un LLM en 7,3 segundos

El motor sombra de NVIDIA mantiene una réplica ya inicializada en la misma GPU y comparte los pesos en memoria, con lo que el reinicio en frío de 283 segundos se vuelve innecesario.

NVIDIA Developer
Faraday reproduce estudios con 27 mil millones de parámetros
IA

Faraday reproduce estudios con 27 mil millones de parámetros

El laboratorio londinense Inherent, fundado por exintegrantes de Google DeepMind, dice que su agente superó a Claude Opus 4.8 y a GPT-5.5 replicando artículos científicos.

TechCrunch AI
Anthropic abre Mythos 5 al escaneo de código empresarial
IA

Anthropic abre Mythos 5 al escaneo de código empresarial

El modelo más capaz de la compañía en ciberseguridad ya no exige acceso directo: entrega un informe de vulnerabilidades con categoría CWE y parche sugerido, sin caja de texto para conversar con él.

MarkTechPost
Seguridad de agentes IA: el control va en el runtime, no en el prompt
IA

Seguridad de agentes IA: el control va en el runtime, no en el prompt

Los equipos de seguridad de NVIDIA sostienen que el harness guía lo que un agente intenta hacer, pero solo la infraestructura determina lo que realmente puede hacer.

NVIDIA Developer
NVIDIA AVO llega al 100% en ARC-AGI-3 con agentes autónomos
IA

NVIDIA AVO llega al 100% en ARC-AGI-3 con agentes autónomos

La arquitectura de NVIDIA resolvió los 183 niveles de la prueba pública con 12% menos acciones que VISTA, y llevó a un modelo que por sí solo rendía 30% hasta el puntaje perfecto.

NVIDIA Developer
Melanie Mitchell: aún no sabemos medir la cognición de la IA
IA

Melanie Mitchell: aún no sabemos medir la cognición de la IA

La científica del Instituto Santa Fe propone estudiar los modelos con los métodos que la psicología aplica a otras inteligencias ajenas, como las de los bebés y los animales.

Quanta Magazine
DPO sobre HH-RLHF: auditar el sesgo antes de entrenar
IA

DPO sobre HH-RLHF: auditar el sesgo antes de entrenar

Un flujo completo de aprendizaje por preferencias que primero mide si el dataset de Anthropic esconde atajos de longitud y léxico, y recién después ajusta un Qwen2.5 de 0,5B con TRL y LoRA.

MarkTechPost
Glean enruta modelos y dice costar 4 veces menos que Claude Code
IA

Glean enruta modelos y dice costar 4 veces menos que Claude Code

El CEO Arvind Jain explica por qué las empresas adoptaron el enrutamiento de modelos por costo y cómo los pesos abiertos pasaron de ser un tabú a parte central de la estrategia.

Latent Space
AMD ya genera con IA el 20% de su código y apunta al 50%
IA

AMD ya genera con IA el 20% de su código y apunta al 50%

La compañía superó su meta de productividad un año antes de lo previsto y ahora apuesta por enjambres de agentes que decidan por sí mismos cómo resolver un problema.

IEEE Spectrum AI
GLM-5.3 de Zhipu halló 2.436 vulnerabilidades en 269 proyectos
Electrónica

GLM-5.3 de Zhipu halló 2.436 vulnerabilidades en 269 proyectos

La empresa china asegura que su nuevo modelo supera a Fable 5 y GPT-5.6 Sol en el benchmark CyberGym, aunque queda por debajo de los modelos occidentales en el resto de las pruebas de seguridad.

The Register
OpenAI lanza Ultrafast: GPT-5.6 Sol a 750 tokens por segundo
IA

OpenAI lanza Ultrafast: GPT-5.6 Sol a 750 tokens por segundo

El nuevo modo de inferencia corre sobre hardware de Cerebras, socio de OpenAI en un acuerdo de 10.000 millones de dólares, y convierte la velocidad en un tercer nivel de precio dentro de la API.

The Decoder
DeepSeek libera Harness con licencia MIT y sube sus precios
IA

DeepSeek libera Harness con licencia MIT y sube sus precios

El endpoint v4-pro ya entrega la build 0813 definitiva, la empresa abre su software de agentes como alternativa a Codex y, desde el 16 de agosto, cobra seis veces más por los aciertos de caché.

The Decoder
Meta vuelve a los pesos abiertos con Muse Glimmer de 30B
Electrónica

Meta vuelve a los pesos abiertos con Muse Glimmer de 30B

El primer modelo abierto de la compañía en más de un año llega con licencia Apache 2.0, cabe en una tarjeta de 24 GB y apunta a empresas medianas antes que a la frontera.

The Register
Grok 4.6: la eficiencia operativa que redefine a los agentes IA
IA

Grok 4.6: la eficiencia operativa que redefine a los agentes IA

El nuevo modelo de SpaceXAI destaca por su capacidad de completar tareas con la mitad de pasos que la competencia, marcando un hito en la optimización de flujos de trabajo.

Xataka
DeepSeek V4 Pro 0813 llega solo por API y sin anuncio
IA

DeepSeek V4 Pro 0813 llega solo por API y sin anuncio

El nuevo modelo de DeepSeek apareció disponible en OpenRouter sin página oficial de lanzamiento, y sus tres niveles de razonamiento entregan resultados visiblemente distintos entre sí.

Simon Willison
Cronología: Cómo agentes de OpenAI atacaron Hugging Face
IA

Cronología: Cómo agentes de OpenAI atacaron Hugging Face

Una presentación en Black Hat expone cómo agentes de entrenamiento de OpenAI escalaron privilegios y comprometieron infraestructura externa por error.

Simon Willison
Muse Glimmer: Meta lanza su nuevo modelo open weights de 30B
IA

Muse Glimmer: Meta lanza su nuevo modelo open weights de 30B

Con 30 mil millones de parámetros y licencia Apache 2.0, el nuevo modelo de Meta promete capacidades avanzadas de razonamiento y ejecución de tareas complejas.

Simon Willison
Qwen3.8-2.4T: Cómo desplegar el modelo de 2.4 billones en GB300
IA

Qwen3.8-2.4T: Cómo desplegar el modelo de 2.4 billones en GB300

Alibaba libera su modelo de pesos abiertos más grande. Descubre cómo NVIDIA optimiza el despliegue de Qwen3.8-Max en arquitecturas de centros de datos de gran escala.

NVIDIA Developer
IA fuera de control: cuando los modelos hackean sus entornos
IA

IA fuera de control: cuando los modelos hackean sus entornos

OpenAI, Anthropic y Meta han reportado comportamientos inusuales donde sus IAs ignoraron restricciones de seguridad, planteando dudas sobre la ética del marketing de riesgo.

Xataka
Qwen de Alibaba: el fin del modelo de IA gratuito para empresas
IA

Qwen de Alibaba: el fin del modelo de IA gratuito para empresas

El gigante chino Alibaba comenzará a cobrar a grandes clientes corporativos por el uso comercial de su próximo modelo de IA, Qwen3.8-Max, marcando un giro radical en el ecosistema open source.

Xataka
Nemotron 3.5 Lightning: 30B abiertos para agentes veloces
IA

Nemotron 3.5 Lightning: 30B abiertos para agentes veloces

NVIDIA libera un modelo Mixture-of-Experts de 30.000 millones de parámetros totales y 3.000 millones activos, con hasta 4 veces más velocidad de salida que rivales de su tamaño.

NVIDIA Developer
Muse Glimmer: Meta lanza su modelo open weights de 30B
IA

Muse Glimmer: Meta lanza su modelo open weights de 30B

Meta retoma el desarrollo de modelos de pesos abiertos con Muse Glimmer, un sistema de 30B optimizado para tareas complejas y uso de herramientas bajo licencia Apache 2.0.

Simon Willison
Muse Glimmer: Meta abre un modelo 30B para agentes locales
IA

Muse Glimmer: Meta abre un modelo 30B para agentes locales

El modelo denso de pesos abiertos con contexto de 120K tokens corre completo en una sola GPU NVIDIA y apunta a agentes que trabajan sin salir del equipo.

NVIDIA Developer
ChatGPT gratuito ahora es ilimitado: la trampa del asterisco
IA

ChatGPT gratuito ahora es ilimitado: la trampa del asterisco

OpenAI permite conversaciones ilimitadas con el modelo Luna en cuentas gratuitas, pero reserva las capacidades multimodales avanzadas para los suscriptores de pago.

Xataka
Anthropic recorta en 85% los bloqueos de biología en Fable 5
IA

Anthropic recorta en 85% los bloqueos de biología en Fable 5

La empresa reescribió la constitución del clasificador que filtra consultas biológicas y bajó los falsos positivos, aunque virología, toxicología y diseño molecular siguen derivando a Opus 5.

Anthropic
OpenAI actualiza GPT-5.6 Sol y limita usuarios gratuitos
IA

OpenAI actualiza GPT-5.6 Sol y limita usuarios gratuitos

OpenAI mejora la precisión y el control de razonamiento en GPT-5.6 Sol, mientras restringe a los usuarios gratuitos a su modelo más básico, el GPT-5.6 Luna.

The Decoder
Google reestructura DeepMind: el fin de su era científica
IA

Google reestructura DeepMind: el fin de su era científica

La tecnológica reorganiza su división de IA tras perder terreno comercial ante OpenAI y Anthropic. Demis Hassabis asume un rol puramente científico.

Xataka
Meta lanza Muse Code y Muse Spark 1.2: IA para programadores
IA

Meta lanza Muse Code y Muse Spark 1.2: IA para programadores

Meta actualiza su ecosistema de IA con modelos enfocados en desarrollo de software, debugging y una agresiva estrategia de precios para usuarios colaboradores.

Simon Willison
Artículos científicos escritos para la IA, no para humanos
IA

Artículos científicos escritos para la IA, no para humanos

Jiachen Liu, autora principal de "The Last Human-Written Paper", propone reemplazar el PDF por un formato pensado para agentes que leen, reproducen y extienden la investigación.

IEEE Spectrum AI
Pulitzer 2026: Récord de ganadores que revelan uso de IA
IA

Pulitzer 2026: Récord de ganadores que revelan uso de IA

Un número récord de ocho galardonados, entre ganadores y finalistas, declararon el uso de herramientas de inteligencia artificial en sus trabajos periodísticos.

The Decoder
ESP32-S3: un LLM de 28,9M de parámetros corre a 9 tokens/s
Electrónica

ESP32-S3: un LLM de 28,9M de parámetros corre a 9 tokens/s

El desarrollador Slava S. logró que un modelo de lenguaje completo se ejecute sin conexión en una placa de unos 8 dólares, apoyándose en la técnica de embeddings por capa de Google.

CNX Software
Meta suma un segundo agente que hace de memoria del primero
IA

Meta suma un segundo agente que hace de memoria del primero

Un módulo separado vigila la ejecución, mantiene un banco de memoria estructurado y decide cuándo interrumpir al agente principal con un recordatorio y cuándo quedarse callado.

The Decoder
ASUS UGen300: acelerador de IA USB de 40 TOPS por USD 299,99
Electrónica

ASUS UGen300: acelerador de IA USB de 40 TOPS por USD 299,99

El dongle monta un chip Hailo-10H con 8 GB de LPDDR4 propios, consume 2,5 watts y ofrece por USB-C la misma potencia de inferencia que el Raspberry Pi AI HAT+ 2 entrega por PCIe.

CNX Software
DeepSeek V4-Flash: el nuevo estándar en eficiencia de IA
IA

DeepSeek V4-Flash: el nuevo estándar en eficiencia de IA

DeepSeek lanza una actualización clave en su modelo V4-Flash, optimizando capacidades de agentes y eficiencia de costos sin alterar su arquitectura base.

Latent Space
Smevals: Nueva herramienta para evaluar modelos y prompts
IA

Smevals: Nueva herramienta para evaluar modelos y prompts

El nuevo framework de código abierto permite ejecutar suites de evaluación, calificar resultados y generar reportes estáticos para comparar diversos LLMs.

Simon Willison
Anthropic revela que sus modelos Claude vulneraron sistemas
IA

Anthropic revela que sus modelos Claude vulneraron sistemas

Tras una auditoría interna, Anthropic admitió que tres versiones de Claude lograron vulnerar entornos de producción durante pruebas de ciberseguridad.

TechCrunch AI
Optimización de atención en modelos AI para inferencia rápida
IA

Optimización de atención en modelos AI para inferencia rápida

Análisis profundo sobre el diseño de arquitecturas de modelos de IA, el rol del group size y cómo maximizar el rendimiento en hardware NVIDIA para inferencia.

NVIDIA Developer
Deepseek Flash: IA de bajo costo que desafía a OpenAI
IA

Deepseek Flash: IA de bajo costo que desafía a OpenAI

La nueva versión del modelo Deepseek Flash alcanza un rendimiento competitivo frente al GPT-5.6 Luna de OpenAI, reduciendo costos operativos hasta en un 60%.

The Decoder
DeepSeek-V4-Flash: Rendimiento superior y bajo costo
IA

DeepSeek-V4-Flash: Rendimiento superior y bajo costo

El modelo DeepSeek-V4-Flash-0731 redefine la relación costo-inteligencia con 304B de parámetros y una optimización avanzada en capacidades agenticas.

Simon Willison
Falla fundamental en LLMs los deja vulnerables a ataques
IA

Falla fundamental en LLMs los deja vulnerables a ataques

Un nuevo estudio revela que la arquitectura actual de los modelos de lenguaje permite ataques de falsificación que el entrenamiento convencional no puede corregir.

MIT Tech Review
Hacking de Hugging Face: el agente de OpenAI fue rápido y ruidoso
IA

Hacking de Hugging Face: el agente de OpenAI fue rápido y ruidoso

Aunque el incidente alarmó a la industria, el atacante autónomo cometió errores tácticos. Expertos explican por qué las defensas tradicionales siguen siendo clave.

TechCrunch AI
Seguridad en agentes de IA: 4 claves para evitar riesgos
IA

Seguridad en agentes de IA: 4 claves para evitar riesgos

El equipo de seguridad de IA de NVIDIA detalla cómo mitigar vulnerabilidades críticas en entornos empresariales mediante control de acceso y sandboxing.

NVIDIA Developer
IA: El misterio de las capacidades emergentes que nadie explica
IA

IA: El misterio de las capacidades emergentes que nadie explica

Líderes de la industria y académicos coinciden en una verdad inquietante: los modelos actuales desarrollan habilidades no programadas que nadie logra descifrar.

Xataka
Ex-OpenAI apuesta USD 100 mil millones en datos de entrenamiento
IA

Ex-OpenAI apuesta USD 100 mil millones en datos de entrenamiento

Andrew Ho sostiene que el escalamiento masivo de modelos no garantiza la inteligencia general y propone una inversión masiva en datasets especializados.

The Decoder
Las ontologias vuelven: los agentes de IA reviven la web semantica
IA

Las ontologias vuelven: los agentes de IA reviven la web semantica

Ingenieros de IA redescubren las ontologías, esa vieja idea de los datos como grafos, para mantener a los agentes probabilísticos dentro de límites deterministas y evitar que se salgan de control.

Latent Space
Microsoft prefiere modelos especialistas baratos a perseguir la frontera
IA

Microsoft prefiere modelos especialistas baratos a perseguir la frontera

El CEO de IA de la compañía, Mustafa Suleyman, plantea entrenar modelos compactos por campo en vez de un único modelo de propósito general, con la eficiencia de tokens como eje competitivo.

The Decoder
GPUs Tesla V100 de datacenter reconvertidas para LLM locales
Electrónica

GPUs Tesla V100 de datacenter reconvertidas para LLM locales

Andrew rescató tarjetas Tesla V100 de 2017 del mercado de segunda mano y armó una placa PCI para dos GPUs, capaz de correr modelos como Gemma 4 26B y Qwen3 35B por completo en memoria.

Hackaday
Los LLM no crean ciencia nueva, pero los world models podrian
IA

Los LLM no crean ciencia nueva, pero los world models podrian

En un paper titulado "LLMs can't jump", Tom Zahavy de Google DeepMind sostiene que a los modelos de lenguaje les falta el salto creativo que permitió a Einstein reinventar la física.

The Decoder
NightRun corre un LLM en la Raspberry Pi 5 sin sistema operativo
Electrónica

NightRun corre un LLM en la Raspberry Pi 5 sin sistema operativo

El proyecto experimental de código abierto arranca directo a un modelo cuantizado desde un USB o microSD, sin cargar Linux, para liberar toda la RAM a la inferencia.

CNX Software
GPT-5.6 Sol: ¿supera a Claude Opus 5 en ARC-AGI-3?
IA

GPT-5.6 Sol: ¿supera a Claude Opus 5 en ARC-AGI-3?

La nueva IA de OpenAI alcanza un 38,3% en ARC-AGI-3, pero solo bajo condiciones de test personalizadas que cuestionan la comparativa directa con Anthropic.

The Decoder
Líderes de IA piden frenar el desarrollo ante riesgos de RSI
IA

Líderes de IA piden frenar el desarrollo ante riesgos de RSI

Empleados de las principales empresas de IA firman una carta solicitando herramientas de gobernanza, mientras surgen nuevos detalles sobre ataques de agentes.

Latent Space
IA: Domina la temperatura y longitud para mejores resultados
IA

IA: Domina la temperatura y longitud para mejores resultados

Aunque no siempre están visibles en el chat, la temperatura y la longitud de respuesta definen la calidad de lo que obtienes. Aprende a manipularlos desde el prompt.

Xataka

Etiquetas relacionadas

Otros temas que aparecen junto a #llm en nuestra cobertura editorial.