Kimi K3 — Especificaciones
Compiled by Mustafa Ihsan from the vendor’s published documentation · Last updated
| Desarrollador | Moonshot AI |
|---|---|
| Tipo | LLM (mixture of experts, razonamiento, multimodal) |
| Modalidad | Texto y visión → texto |
| Parámetros | 2,8 billones totales / 16 de 896 expertos activos (MoE) |
| Ventana de contexto | 1 millón |
| Licencia | Pesos abiertos (previstos para el 27-07-2026) |
| Pesos abiertos | Sí |
| Lanzado | 2026-07 |
| Precio de entrada | $3.00 /1M |
| Precio de salida | $15.00 /1M |
| Proveedores de API | Moonshot (Kimi), OpenRouter |
Ejecútelo localmente
| VRAM (4 bits) | ~1,4 TB |
|---|---|
| GPU mínima | Clúster multinodo (p. ej., 2 × nodos H200 de 8 GPU y 141 GB) |
¿Qué es Kimi K3?
Kimi K3 es el modelo abierto de vanguardia de Moonshot AI, con 2,8 billones de parámetros —una mezcla de expertos—
que activa solo 16 de sus 896 expertos por token, con una ventana de contexto de 1 millón de tokens, visión nativa y
razonamiento continuo. Obtiene una puntuación de 57 en el Índice de Inteligencia Artificial Analysis,
superando ligeramente a Claude Opus 4.8 (56) y quedando solo por detrás de GPT-5.6 Sol (59) y Claude Fable 5 (60),
el mejor resultado registrado hasta la fecha para un modelo de pesos abiertos. Los pesos se publicarán el 27 de julio de 2026.
La relevancia radica en la brecha, o más bien en su ausencia. Un modelo de pesos abiertos que se sitúa
a tan solo tres puntos del mejor modelo cerrado del mercado elimina el último argumento cómodo
para pagar precios de vanguardia únicamente por motivos de capacidad. Con un costo combinado de 3 $/millón de tokens de entrada y 15 $/millón de tokens de salida, Kimi K3 cuesta la mitad que GPT-5.5
millones de tokens. K3 también tiene la mitad del costo combinado de GPT-5.5, aunque obtiene una puntuación más alta. La trampa es
en su propio centro de datos. Para casi todos los usuarios, Kimi K3 representa una decisión sobre el uso de una API que, de forma adicional, ofrece una vía de salida.
ejecutables en su propio centro de datos. Para casi todos los usuarios, Kimi K3 representa una decisión sobre el uso de una API que, de forma adicional, ofrece una vía de salida.
ejecutables en su propio centro de datos. Para casi todos los usuarios, Kimi K3 representa una decisión sobre el uso de una API que, de forma adicional, ofrece una vía de salida.
ejecutables en su propio centro de datos. Para casi todos los usuarios, Kimi K3 representa una decisión sobre el uso de una API que, de forma adicional, ofrece una vía de salida.
Precio de Kimi K3: costo de la API por 1 millón de tokens
| Entrada (por cada millón de tokens) | $3.00 |
|---|---|
| Salida (por cada millón de tokens) | $15.00 |
| Relación salida/entrada | 5× |
| Combinada (4:1 entrada:salida) | $5.40 por 1 millón de tokens |
Cuánto cuesta Kimi K3 al mes
Gasto mensual real con una mezcla entrada:salida de 4:1, es decir, la proporción que realmente genera una carga de trabajo típica de chat o RAG.
| Carga de trabajo | Tokens/mes | Coste mensual |
|---|---|---|
| Proyecto secundario | 1 millón de tokens de entrada / 0,25 millones de tokens de salida | $6.75 |
| Pequeño equipo | 20 millones de tokens de entrada / 5 millones de tokens de salida | $135 |
| Producción | 200 millones de tokens de entrada / 50 millones de tokens de salida | $1,350 |
Calcule sus propios números en la Calculadora de costos de API de IA.
Alternativas más económicas a Kimi K3
| Modelo | Dólares por millón combinados | Usted ahorra |
|---|---|---|
| GLM 5.2 abierta | $2.00 | 63 % más barato |
| Gemini 3.5 Flash | $3.00 | 44 % más barato |
| Gemini 3.1 Pro | $4.00 | 26 % más barato |
¿Autoalojarlo o pagar por la API?
Kimi K3 es de pesos abiertos, por lo que puede ejecutarlo usted mismo. Requiere ~1,4 TB de VRAM en cuantización de 4 bits (clúster multinodo, por ejemplo, dos nodos H200 de 8 GPU y 141 GB). Autoalojarlo solo resulta más económico que usar la API cuando su volumen es lo suficientemente alto como para mantener ocupado ese hardware —el calculadora de autohospedaje frente a API calcula el punto de equilibrio para su volumen de tokens.
Preguntas frecuentes
¿Cuánto cuesta Kimi K3 por 1 millón de tokens?
Kimi K3 cuesta 3,00 $ por 1 millón de tokens de entrada y 15,00 $ por 1 millón de tokens de salida. Con una proporción típica entrada/salida de 4:1, el costo combinado asciende a aproximadamente 5,40 $ por 1 millón de tokens.
¿Cuánto cuesta Kimi K3 al mes?
Una carga de trabajo mensual de un pequeño equipo de 20 millones de tokens de entrada y 5 millones de tokens de salida cuesta aproximadamente 135 $ con Kimi K3. Un proyecto secundario (1 millón de tokens de entrada / 0,25 millones de tokens de salida) cuesta aproximadamente 6,75 $.
¿Cuál es una alternativa más económica a Kimi K3?
GLM 5.2 es la opción más económica y potente disponible en nuestra base de datos, a 2,00 $ por 1 millón de tokens combinados —aproximadamente un 63 % menos que Kimi K3. También es de pesos abiertos, por lo que la autohospedaje es una opción viable.
¿Puedo ejecutar Kimi K3 localmente?
Sí. Kimi K3 es de pesos abiertos y requiere aproximadamente 1,4 TB de VRAM en cuantización de 4 bits (clúster multinodo, por ejemplo, dos nodos H200 de 8 GPU y 141 GB cada uno).
¿Por qué Kimi K3 cobra más por los tokens de salida que por los de entrada?
Los tokens de salida se generan uno a uno y no pueden agruparse (batching) como sí ocurre con los prompts, por lo que su procesamiento supone un mayor costo para el proveedor. Kimi K3 cobra cinco veces más por los tokens de salida, razón por la cual las cargas de trabajo centradas en prompts son mucho más económicas que las centradas en generación.
Los precios corresponden a las tarifas oficiales publicadas para la API principal del modelo y se revisan periódicamente conforme los proveedores los actualicen. No incluyen descuentos por volumen, procesamiento por lotes ni entradas en caché. Compare todos los modelos uno al lado del otro en la Base de datos de modelos de IA o el Clasificación de modelos de lenguaje grande (LLM).

