Tencent liberó oficialmente su modelo de IA Hy3. El modelo usa una arquitectura Mixture-of-Experts (MoE) con 295 mil millones de parámetros totales. De esos, 21 mil millones están activos en cualquier momento, más 3,8 mil millones de parámetros para una capa MTP adicional. Soporta longitudes de contexto de hasta 256.000 tokens.
Tencent afirma que Hy3 iguala el rendimiento de modelos de dos a cinco veces su tamaño activo. En una evaluación ciega con 270 expertos, Hy3 obtuvo 2,67 sobre 4 puntos, superando a GLM-5.1 (2,51). Las pruebas internas mostraron que la tasa de alucinación bajó del 12,5% al 5,4%.
¿Cómo se compara con la competencia open source?

| Modelo | Params totales | Params activos | Contexto | Score panel ciego |
|---|---|---|---|---|
| Tencent Hy3 | 295B | 21B (+3,8B MTP) | 256K | 2,67 / 4 |
| GLM-5.1 | (no publicado) | (no publicado) | (no publicado) | 2,51 / 4 |
La ventaja principal de Hy3 está en la eficiencia MoE: activa solo un 7,1% de sus parámetros por inferencia. Esto lo posiciona directo contra otros MoE chinos como DeepSeek-V3 (671B totales, 37B activos) y GLM-5.1. La cifra de reducción de alucinaciones (de 12,5% a 5,4%, o un 57% menos) es agresiva y aún requiere validación externa por benchmarks estándar como TruthfulQA y HELM.
¿Cómo descargarlo y usarlo?
Hy3 está disponible bajo licencia Apache 2.0 en Hugging Face, ModelScope y GitHub. También hay disponible una versión cuantizada en FP8. El soporte para plataformas como OpenRouter y Cline está planificado.
Tencent ya integró el modelo a sus propios productos, incluyendo WorkBuddy, Yuanbao, WeChat y el asistente de juego para Path of Exile: Advent.
¿Qué significa para el ecosistema latino?
Para desarrolladores en Chile y LatAm que trabajan con LLMs open source, Hy3 abre un tercer camino junto a los pesos abiertos de Meta (Llama) y DeepSeek. La licencia Apache 2.0, más permisiva que la comunitaria de Llama, permite uso comercial sin las cláusulas de escala (menos de 700M usuarios activos) que Meta impone. La versión FP8 baja el costo de despliegue: correr un MoE 21B activo cuantizado a FP8 cabe en una sola GPU H100 de 80 GB o dos MI300X, con precio spot en AWS us-east-1 desde USD 3,80 por hora para H100 hoy.




