Ayer, mientras todo el mundo esperaba el lanzamiento de Gemini 3.5 Pro para hoy, Moonshot AI mandó una bomba silenciosa: Kimi K3, el modelo de lenguaje abierto más grande del mundo, construido en China sin acceso a los chips H100 y A100 de NVIDIA que usan los laboratorios occidentales.
Los números que importan
Kimi K3 tiene 2,8 billones de parámetros totales, más del doble que DeepSeek V4 (1,6 billones) y el mayor modelo open-weight que existe hoy. No hay nada parecido disponible públicamente. Usa una arquitectura Mixture-of-Experts (MoE), lo que significa que no activa todos esos parámetros a la vez — solo un subconjunto por cada token procesado.
La ventana de contexto es de 1 millón de tokens, mismo nivel que los modelos premium de Anthropic y OpenAI. Hay dos variantes en el lanzamiento: K3 Max para chat y tareas agénticas generales, y K3 Swarm Max pensado para procesamiento paralelo masivo — básicamente para cuando querés correr miles de subtareas al mismo tiempo.
Qué tan bueno es
Moonshot afirma en su release oficial que K3 compite "de manera comparable" con Fable 5 (el modelo más avanzado de Anthropic) y supera sustancialmente a Claude Opus 4.8 y GPT-5.6 Sol. Los benchmarks propios que publicaron respaldan esas afirmaciones: 93,5% en GPQA Diamond y 91,2% en BrowseComp, que son los dos benchmarks donde la diferencia entre modelos top es más visible.
Hay que leerlo con algo de escepticismo — son benchmarks del propio laboratorio. Lo que sí es cierto y verificable es que DoorDash ya usa Kimi para trabajo de bajo nivel internamente, y Cursor usó una versión anterior (K2) para construir su agente de código Composer 2. Eso es adopción real de empresas que eligieron Kimi sobre modelos de OpenAI y Anthropic.
El contexto político que lo hace más relevante
La parte interesante de esta historia no es solo técnica. El gobierno de EEUU aplicó controles de exportación que le impiden a China acceder a los chips de NVIDIA más avanzados. Moonshot tuvo que construir K3 con hardware más limitado, lo que los obligó a enfocarse en eficiencia algorítmica en lugar de escalar hardware. Como dijo el presidente de Moonshot en el Foro Económico Mundial: "Sabíamos que no teníamos el lujo de simplemente agregar más cómputo".
El resultado es que China ahora tiene un modelo open-weight que Fortune afirma compite con Fable 5 — el modelo que el propio gobierno de EEUU consideró lo suficientemente riesgoso como para restringirlo temporalmente en junio. Los analistas esperaban que China llegara a este nivel a principios de 2027. Llegaron medio año antes.
Precio y acceso
Vía API: USD 3 por millón de tokens de entrada y USD 15 por millón de salida. Es caro para un modelo chino (DeepSeek V4 sale a USD 0,87/M de output), pero mucho más barato que el equivalente occidental (Fable cuesta USD 50 por millón de tokens de salida). El modelo ya está disponible en Kimi Code y la app de Kimi (incluyendo iOS).
Los pesos open source llegan el 27 de julio. Cuando eso pase, cualquiera va a poder descargarlo y ejecutarlo localmente — aunque con 2,8 billones de parámetros vas a necesitar hardware serio para que corra de manera útil.
Por qué nos importa en Argentina
Primero, porque el acceso a K3 vía API es significativamente más barato que los modelos de Anthropic y OpenAI si lo usás para desarrollo o automatización. Segundo, porque cuando lleguen los pesos abiertos el 27 de julio, K3 se convierte en una opción viable para cualquiera que quiera correr un modelo de frontera sin depender de servicios pagos. Para desarrolladores indie o equipos chicos, eso puede importar bastante.