Saltar al contenido
Etiqueta

#qwen

16 notas publicadas

GLM-5.3-Flash y Qwen3.8-Flash-Next comparten arquitectura
IA

GLM-5.3-Flash y Qwen3.8-Flash-Next comparten arquitectura

Z.ai y el equipo Qwen de Alibaba liberaron sus modelos sin coordinarse, pero las configuraciones son casi copias: mismo ratio de atención, mismo tope de 2.048 tokens y cuatro flujos residuales.

MarkTechPost
Qwen3.8-Flash-Next: 125B con solo 6B activos por token
IA

Qwen3.8-Flash-Next: 125B con solo 6B activos por token

El nuevo modelo multimodal de peso abierto de Alibaba anticipa la arquitectura de Qwen4 y, según el equipo, se entrenó por cerca de un noveno de lo que costó Qwen3.7-Plus.

MarkTechPost
Qwen3.8-Flash-Next: 16.000 tokens por segundo por GPU
IA

Qwen3.8-Flash-Next: 16.000 tokens por segundo por GPU

NVIDIA publicó la validación del modelo de Alibaba sobre el rack GB300 NVL72 y detalló la arquitectura híbrida que le permite sostener contextos de un millón de tokens sin inflar la caché KV.

NVIDIA Developer
Qwen3.8-Flash-Next activa solo 6.000 millones de parámetros
IA

Qwen3.8-Flash-Next activa solo 6.000 millones de parámetros

El modelo de Alibaba adelanta la arquitectura de Qwen4 con una capa de n-gramas que vive en la RAM del sistema, y cuesta doce veces menos que el buque insignia de la casa.

The Decoder
Faraday reproduce estudios con 27 mil millones de parámetros
IA

Faraday reproduce estudios con 27 mil millones de parámetros

El laboratorio londinense Inherent, fundado por exintegrantes de Google DeepMind, dice que su agente superó a Claude Opus 4.8 y a GPT-5.5 replicando artículos científicos.

TechCrunch AI
Qwen3.8-2.4T: Cómo desplegar el modelo de 2.4 billones en GB300
IA

Qwen3.8-2.4T: Cómo desplegar el modelo de 2.4 billones en GB300

Alibaba libera su modelo de pesos abiertos más grande. Descubre cómo NVIDIA optimiza el despliegue de Qwen3.8-Max en arquitecturas de centros de datos de gran escala.

NVIDIA Developer
Qwen de Alibaba: el fin del modelo de IA gratuito para empresas
IA

Qwen de Alibaba: el fin del modelo de IA gratuito para empresas

El gigante chino Alibaba comenzará a cobrar a grandes clientes corporativos por el uso comercial de su próximo modelo de IA, Qwen3.8-Max, marcando un giro radical en el ecosistema open source.

Xataka
Modelos abiertos chinos retan el manual de Silicon Valley
IA

Modelos abiertos chinos retan el manual de Silicon Valley

Z.ai, Moonshot y Alibaba lanzaron GLM 5.2, Kimi K3 y Qwen 3.8 con pesos abiertos y rendimiento casi de frontera, justo cuando los laboratorios estadounidenses se vuelven más cerrados.

Wired
Kimi K3 y el giro de China hacia la IA de codigo abierto
IA

Kimi K3 y el giro de China hacia la IA de codigo abierto

Un repaso al estado de los modelos abiertos: Kimi K3, el anuncio de Qwen de liberar pesos, el respaldo de Xi Jinping al open source y cuanto falta para alcanzar a la frontera cerrada.

Interconnects
Qwen Audio 3.0 TTS Plus lidera el ranking de texto a voz
IA

Qwen Audio 3.0 TTS Plus lidera el ranking de texto a voz

El modelo de Alibaba encabeza la Speech Arena de Artificial Analysis con 1.236 puntos Elo, apenas dos por encima de Simba 3.2, aunque su velocidad de generación queda muy por debajo de la competencia.

The Decoder
Qwen-Image-3.0 de Alibaba: texto legible de diez píxeles
IA

Qwen-Image-3.0 de Alibaba: texto legible de diez píxeles

La tercera versión del generador de Alibaba maqueta diarios, papers en LaTeX y grillas de infografías en una sola pasada, pero llega cerrada y solo por invitación a la API.

The Decoder
Qwen 3.8: Alibaba planta cara a Kimi K3 con pesos abiertos
IA

Qwen 3.8: Alibaba planta cara a Kimi K3 con pesos abiertos

El modelo multimodal de 2,4 billones de parámetros llega en versión preview y busca frenar el impulso de Kimi K3 antes de que Moonshot AI salga a bolsa.

The Decoder
Apple Intelligence llega a China con la IA Qwen de Alibaba
IA

Apple Intelligence llega a China con la IA Qwen de Alibaba

El regulador chino aprobó los servicios de IA de Apple tras un acuerdo para integrar el modelo Qwen de Alibaba en iOS, iPadOS, macOS y visionOS.

TechCrunch
Bonsai 27B, el modelo de razonamiento abierto que cabe en un iPhone
IA

Bonsai 27B, el modelo de razonamiento abierto que cabe en un iPhone

PrismML comprimió un modelo de 27.000 millones de parámetros a menos de 4 GB conservando cerca del 90% del rendimiento, y Apple ya estaría probando la tecnología para su IA en el dispositivo.

The Decoder
Ahmad Osman: la IA local está a 4-8 meses de los modelos frontier
IA

Ahmad Osman: la IA local está a 4-8 meses de los modelos frontier

El fundador de Osmantic dio dos talleres en el AI Engineer World's Fair sobre cómo desplegar LLM open source en workstations propias, con público que fue de estudiantes a ejecutivos de Intel.

Latent Space

Etiquetas relacionadas

Otros temas que aparecen junto a #qwen en nuestra cobertura editorial.