
WikiSkill: Google le da a sus agentes una wiki de errores
El marco de Google Research guarda lo aprendido en cada corrida dentro de una base de conocimiento permanente y sube a Gemini 3.5 Flash de 49,5% a 68,1% de promedio.
16 notas publicadas

Z.ai y el equipo Qwen de Alibaba liberaron sus modelos sin coordinarse, pero las configuraciones son casi copias: mismo ratio de atención, mismo tope de 2.048 tokens y cuatro flujos residuales.

El nuevo modelo multimodal de peso abierto de Alibaba anticipa la arquitectura de Qwen4 y, según el equipo, se entrenó por cerca de un noveno de lo que costó Qwen3.7-Plus.

NVIDIA publicó la validación del modelo de Alibaba sobre el rack GB300 NVL72 y detalló la arquitectura híbrida que le permite sostener contextos de un millón de tokens sin inflar la caché KV.

El modelo de Alibaba adelanta la arquitectura de Qwen4 con una capa de n-gramas que vive en la RAM del sistema, y cuesta doce veces menos que el buque insignia de la casa.

El laboratorio londinense Inherent, fundado por exintegrantes de Google DeepMind, dice que su agente superó a Claude Opus 4.8 y a GPT-5.5 replicando artículos científicos.

Alibaba libera su modelo de pesos abiertos más grande. Descubre cómo NVIDIA optimiza el despliegue de Qwen3.8-Max en arquitecturas de centros de datos de gran escala.

El gigante chino Alibaba comenzará a cobrar a grandes clientes corporativos por el uso comercial de su próximo modelo de IA, Qwen3.8-Max, marcando un giro radical en el ecosistema open source.

Z.ai, Moonshot y Alibaba lanzaron GLM 5.2, Kimi K3 y Qwen 3.8 con pesos abiertos y rendimiento casi de frontera, justo cuando los laboratorios estadounidenses se vuelven más cerrados.

Un repaso al estado de los modelos abiertos: Kimi K3, el anuncio de Qwen de liberar pesos, el respaldo de Xi Jinping al open source y cuanto falta para alcanzar a la frontera cerrada.

El modelo de Alibaba encabeza la Speech Arena de Artificial Analysis con 1.236 puntos Elo, apenas dos por encima de Simba 3.2, aunque su velocidad de generación queda muy por debajo de la competencia.

La tercera versión del generador de Alibaba maqueta diarios, papers en LaTeX y grillas de infografías en una sola pasada, pero llega cerrada y solo por invitación a la API.

El modelo multimodal de 2,4 billones de parámetros llega en versión preview y busca frenar el impulso de Kimi K3 antes de que Moonshot AI salga a bolsa.

El regulador chino aprobó los servicios de IA de Apple tras un acuerdo para integrar el modelo Qwen de Alibaba en iOS, iPadOS, macOS y visionOS.

PrismML comprimió un modelo de 27.000 millones de parámetros a menos de 4 GB conservando cerca del 90% del rendimiento, y Apple ya estaría probando la tecnología para su IA en el dispositivo.

El fundador de Osmantic dio dos talleres en el AI Engineer World's Fair sobre cómo desplegar LLM open source en workstations propias, con público que fue de estudiantes a ejecutivos de Intel.
Otros temas que aparecen junto a #qwen en nuestra cobertura editorial.