Kimi lanzó K3, un modelo multimodal de pesos abiertos que la empresa presenta como el primer sistema open source en el rango de los 3 billones de parámetros. Con 2,8 billones de parámetros totales, procesamiento nativo de imágenes y video, y una ventana de contexto de un millón de tokens, apunta directo a las tareas de programación de larga duración, el trabajo del conocimiento y el razonamiento complejo.
¿Qué tan potente es K3?

En los benchmarks de la propia Kimi, K3 todavía queda por detrás de los modelos propietarios de punta Claude Fable 5 y GPT-5.6 Sol, pero supera por amplio margen a todos los demás sistemas evaluados, incluidos los modelos Claude Opus y el rival chino GLM-5.2. La empresa aclara que sus resultados se obtuvieron con intensidad de razonamiento máxima o alta.
Según Kimi, K3 gana dos de seis benchmarks de programación y queda segundo o tercero en el resto. Entre los agentes generales, se lleva tres de seis pruebas. A lo largo de los 35 tests, K3 obtuvo el primer lugar unas siete veces y quedó segundo o tercero en la mayoría del resto. Un detalle metodológico: los resultados no se recolectaron todos en condiciones idénticas, ya que cada benchmark usó uno de tres sistemas de agente distintos (KimiCode, Claude Code o Codex).
El laboratorio independiente Artificial Analysis confirmó en gran medida el rendimiento, aunque con un asterisco importante. K3 anota 57 en el Artificial Analysis Intelligence Index, lo que lo ubica cuarto detrás de Claude Fable 5 (60), GPT-5.6 Sol (59) y Claude Opus 4.8 (56). En tareas agénticas alcanza un Elo de 1.668 en GDPval v2, un salto enorme frente a los 1.190 de K2.6.
¿Cuál es la letra chica?

El punto débil aparece en las alucinaciones. Mientras la tasa de precisión de K3 mejoró del 33% al 46% en el AA-Omniscience Index, su tasa de alucinación trepó del 39% al 51%. En otras palabras: acierta más preguntas, pero también inventa más respuestas.
Vision in the Loop: más allá del fragmento de código
Kimi posiciona a K3 para proyectos de desarrollo completos, no solo snippets. El modelo está construido para analizar bases de código grandes, coordinar herramientas de terminal y mantener el foco a lo largo de muchos pasos con mínima supervisión humana. Su sistema de bucle cerrado, que la empresa llama Vision in the Loop, examina capturas de pantalla, modifica el código y luego verifica el resultado visible. Kimi lo presenta como base para desarrollo de videojuegos, diseño de interfaces y CAD.
Como demostraciones, la empresa mostró un juego 3D de mundo abierto generado proceduralmente que K3 habría construido entero en el navegador usando Three.js, WebGPU y GPU Compute, además de una visualización interactiva de un agujero negro, una simulación del cohete Long March 10 y un emulador de Game Boy Advance.
En lo técnico, K3 usa una arquitectura de mezcla de expertos que activa solo 16 de 896 expertos por vez, combinada con un nuevo mecanismo llamado Kimi Delta Attention que, según la empresa, permite una decodificación hasta 6,3 veces más rápida en contextos de un millón de tokens.
¿Cuánto cuesta y se acabó el modelo chino barato?
Acá está el giro de la historia. Según la documentación de la API de Kimi, un millón de tokens de entrada cuesta 0,30 dólares con cache hit y 3,00 dólares sin él. El millón de tokens de salida, razonamiento incluido, cuesta 15,00 dólares. Eso ubica a K3 muy por encima de su antecesor K2.6 y confirma que los proveedores chinos ya no ofrecen sus modelos de frontera a precios de remate.
| Modelo | Entrada (cache) | Entrada (sin cache) | Salida |
|---|---|---|---|
| Kimi K3 | 0,30 | 3,00 | 15,00 |
| Kimi K2.6 | 0,16 | 0,95 | 4,00 |
| Claude Sonnet 5 | 0,30 | 3,00 | 15,00 |
| Claude Fable 5 | 1,00 | 10,00 | 50,00 |
| GPT-5.6 Sol | 0,50 | 5,00 | 30,00 |
(Precios en dólares por millón de tokens.)
Aun así, K3 sigue siendo bastante más barato que los modelos occidentales de punta y se ubica en la franja media-alta. Según Artificial Analysis promedia 0,94 dólares por tarea en el Intelligence Index, cercano a los 1,04 de GPT-5.6 Sol y aproximadamente la mitad de los 1,80 de Opus 4.8. Como referencia, un equipo en Chile que hoy paga por Sonnet 5 pagaría exactamente lo mismo por token de K3 (0,30 y 15,00 dólares), pero con pesos abiertos que permiten correr el modelo en infraestructura propia.
¿Cuándo y dónde está disponible?
K3 ya está disponible en Kimi.com, la app móvil para iOS, Android y HarmonyOS, el cliente de escritorio Kimi Work (versión 3.1.0 en adelante) y Kimi Code. En OpenRouter aparece bajo el identificador moonshotai/kimi-k3. Los pesos abiertos se esperan para antes de fin de julio, con fecha objetivo el 27 de julio.




