Kimi K3 llega con cifras que llaman la atención: 2,8 billones de parámetros totales, un millón de tokens de contexto y visión nativa. Pero la decisión útil para una empresa no sale de una tabla de benchmarks. Sale de separar qué está disponible, qué sigue siendo una promesa y qué trabajo concreto mejora de verdad.
La captura lo situaba con 1.679 puntos en una evaluación de preferencia humana sobre interfaces web. Es una fotografía del ranking, no una medida universal de calidad, y puede cambiar con nuevos votos.
Consultar el ranking vivo en Arena ↗Qué ha lanzado Moonshot
Moonshot presenta K3 como un modelo multimodal de mezcla de expertos. De sus 896 expertos, activa 16 por token. La compañía publica una ventana de contexto de un millón de tokens y lo orienta a código, investigación, navegación y trabajos largos. El modelo está disponible en Kimi.com, Kimi Work, Kimi Code y su API.
El precio anunciado es de 0,30 dólares por millón de tokens de entrada con caché, 3 dólares sin caché y 15 dólares por millón de tokens de salida. El dato importante no es que parezca barato por token: el coste que una empresa debe medir es el coste por tarea terminada, incluyendo latencia, errores y retrabajo.
Moonshot también publica resultados altos en pruebas de código, navegación y razonamiento. Son resultados del proveedor, con distintos agentes, temperaturas y acceso a herramientas. Sirven para decidir qué probar; no bastan para afirmar que K3 sea el mejor modelo para cualquier empresa.
Kimi K3 está disponible hoy. Su apertura completa tiene fecha futura.
Datos publicados por Moonshot AI · corte 17.07.2026
Por qué ha generado tanta atención
El lanzamiento superó el millar de votos en un hilo de r/LocalLLaMA. La conversación mezcla entusiasmo por el precio y la apertura prometida con dudas razonables sobre benchmarks internos, coste por tarea y capacidad real de despliegue.
Hecho
HechoEl servicio está operativo y Moonshot ha fijado una fecha concreta para liberar pesos e informe técnico.
Lectura DÍA UNO
Lectura DÍA UNOLa noticia no justifica migrar. Sí justifica añadir K3 a una evaluación comparativa con tareas reales.
La prueba que haríamos esta semana
- Investigación documental.
El mismo paquete de fuentes y la misma pregunta, midiendo citas correctas, omisiones, tiempo y coste.
- Auditoría de código en solo lectura.
Un repositorio aislado, sin credenciales ni permisos de escritura, con criterios de aceptación definidos.
- QA visual.
Capturas de una interfaz real y una lista cerrada de fallos que el modelo debe detectar.
- Revalidación el 27 de julio.
Comprobar pesos, licencia, model card, despliegue y política de datos antes de ampliar el uso.
Qué sabemos y qué sigue abierto
| Estado | Qué podemos afirmar |
|---|---|
| Confirmado | K3 está disponible en las superficies y API de Kimi. |
| Publicado por Moonshot | Arquitectura, contexto, precios y resultados de benchmark. |
| Pendiente | Pesos completos, licencia final, informe técnico y soporte de despliegue. |
| Decisión empresarial | Probar coste por tarea y revisar privacidad, DPA y transferencias antes de usar datos sensibles. |
Fuentes y método
- Fuente primariaMoonshot AI: Kimi K3, ficha y notas de lanzamiento
- Evaluación independienteArena AI: Frontend Code Arena y ranking vivo
- CondicionesAcuerdo de uso de modelos de la API de Kimi
- Señal públicaDebate de lanzamiento en LocalLLaMA
- EcosistemaOrganización oficial de Moonshot AI en GitHub