Los precios de la API de DeepSeek comienzan en 0,14 USD por cada millón de tokens de entrada en DeepSeek V4-Flash, aproximadamente
una sesentava parte de lo que cobran los modelos de vanguardia. Esa brecha, no el número de parámetros, es la razón por la cual
DeepSeek resulta relevante. Además, todos los modelos de esta línea se publican bajo una licencia abierta, por lo que el precio de la API constituye un cargo por conveniencia, no la única forma de ejecutarlos.
Precios de la API de DeepSeek: cada modelo, por cada millón de tokens
Cuánto cuesta DeepSeek al mes
| Modelos | Entrada: $/1 millón | Salida: $/1 millón | Dólares por millón combinados | Contexto |
|---|---|---|---|---|
| DeepSeek V4-Flash pesos abiertos | $0.140 | $0.280 | $0.168 | 1 millón |
| DeepSeek V4-Pro pesos abiertos | $0.435 | $0.870 | $0.522 | 1 millón |
| DeepSeek R1 Distill Llama 70B pesos abiertos | $0.800 | $0.800 | $0.800 | 128 K |
| DeepSeek R1 pesos abiertos | $0.500 | $2.15 | $0.830 | 128 K |
«Combinado» es la tarifa efectiva para una proporción entrada/salida de 4:1, que es la que realmente genera una carga de trabajo típica de chat o recuperación de información. Es el valor que debe compararse entre proveedores; un precio publicitario solo para la entrada oculta el coste real del lado de la salida.
Cómo se compara DeepSeek con otros proveedores
| Carga de trabajo | Tokens/mes | DeepSeek V4-Flash más económico | DeepSeek R1 nivel más potente |
|---|---|---|---|
| Proyecto secundario | 1 millón de tokens de entrada / 0,25 millones de tokens de salida | $0.21 | $1.04 |
| Pequeño equipo | 20 millones de tokens de entrada / 5 millones de tokens de salida | $4.20 | $21 |
| Producción | 200 millones de tokens de entrada / 50 millones de tokens de salida | $42 | $208 |
Modele sus propios volúmenes en la Calculadora de costos de API de IA.
¿Qué modelo de DeepSeek debería usar usted?
El modelo más económico de cada proveedor, de modo que la comparación sea homogénea desde el punto de vista del coste de entrada.
| Proveedor | Modelo más económico | Dólares por millón combinados |
|---|---|---|
| Mistral AI | Mistral 7B | $0.0220 |
| Meta | Llama 3.1 8B | $0.0220 |
| Alibaba | Qwen3 8B | $0.0600 |
| Gemma 3 4B | $0.0600 | |
| Microsoft | Phi-4 | $0.0840 |
| DeepSeek esta página | DeepSeek V4-Flash | $0.168 |
| Moonshot AI | Kimi K2.7 Code | $0.980 |
| Anthropic | Claude Haiku 4.5 | $1.80 |
| Zhipu AI | GLM 5.2 | $2.00 |
| xAI | Grok 4 | $5.40 |
| OpenAI | GPT-5.6 Sol | $10.00 |
Lo más económico no equivale necesariamente al mejor valor; compruebe también las capacidades junto con el precio en la Clasificación de modelos de lenguaje grande (LLM), o explore todos los modelos disponibles en la Base de datos de modelos de IA.
es el modelo de alto rendimiento por volumen: 284 000 millones de parámetros en total, con unos 13 000 millones
V4-Flash activos por token, un contexto de 1 millón de tokens y una tarifa combinada cercana a 0,17 USD por cada millón de tokens, frente a los 10 USD de un modelo de vanguardia.
Para clasificación masiva, procesamiento de documentos, resúmenes preliminares, generación de datos sintéticos y la capa de recuperación de una canalización RAG, su relación capacidad/precio es prácticamente insuperable.
Un contexto de 1 millón de tokens a ese precio no existe en ningún otro lugar.
es la versión abierta insignia: una mezcla de expertos de 1,6 billones de parámetros
que activa aproximadamente 49 000 millones de parámetros por token, con un contexto de 1 millón de tokens. Con una tarifa combinada de unos 0,52 USD,
V4-Pro su costo representa aproximadamente una vigésima parte del precio de los modelos de vanguardia, manteniendo un desempeño sólido en razonamiento general.
R1
es el modelo abierto de referencia para razonamiento: una mezcla de expertos de 671 000 millones de parámetros con 37 000 millones
activos, que ofrece razonamiento paso a paso (chain-of-thought) a una fracción del costo de los modelos propietarios. Su contexto de 128 K es más estrecho que los 1 millón de tokens de la línea V4.
R1 Distill Llama 70B
existe por una sola razón: el hardware. El modelo completo R1 requiere aproximadamente
400 GB de VRAM en cuantización de 4 bits; la versión distill necesita unos 40 GB, lo que permite pasar de «alquilar un servidor» a «comprar una estación de trabajo». Además, cobra 0,80 USD tanto por tokens de entrada como de salida, por lo que las cargas de trabajo centradas en la generación no cuestan más que las centradas en los prompts —una estructura inusualmente sencilla de presupuestar.
El costo de cambio es menor de lo que parece
El detalle que convierte a DeepSeek en una opción realista, y no meramente curiosa, es que la API de V4-Pro
acepta tanto los formatos de solicitud de OpenAI como de Anthropic. La migración suele requerir únicamente cambiar la URL base y la clave de acceso, sin necesidad de reescribir el código. Así, la fricción habitual de integración que protege a los proveedores establecidos desaparece en gran medida, lo que hace que una diferencia de costos 20 veces mayor sea realmente aprovechable, no solo teórica.
El patrón sensato no es una migración total, sino un enrutamiento inteligente: enviar la mayor parte del tráfico —de alto volumen y baja criticidad— a V4-Flash, y reservar un modelo de vanguardia únicamente para las solicitudes que genuinamente lo requieran. La mayoría de las aplicaciones descubren que la división se inclina fuertemente hacia la opción económica.
¿Cambian los pesos abiertos los cálculos?
Todos los modelos de DeepSeek mencionados aquí son descargables de forma abierta, lo que plantea una pregunta obvia. Para la mayoría de los equipos, la respuesta sincera es que la licencia brinda auditabilidad y portabilidad entre proveedores, más que una implementación realista en instalaciones propias.
La razón radica en los requisitos de hardware. V4-Pro necesita aproximadamente 800 GB de VRAM en cuantización de 4 bits: una operación a escala de centro de datos que implica ocho GPU H100 de 80 GB o más. R1 requiere unos 400 GB. V4-Flash necesita unos 140 GB, o dos GPU H100 de 80 GB. Solo la versión distill de R1, con 40 GB, cabe en el hardware que un equipo pequeño podría adquirir efectivamente.
Frente a unos precios de API tan bajos, la autohospedaje debe superar una alta barrera: solo resulta rentable cuando el volumen es suficientemente alto como para mantener ese hardware ocupado de forma continua, y el punto de equilibrio cambia cada vez que DeepSeek reduce sus precios. Calcule este punto según su propio volumen de tokens antes de comprometerse con la adquisición de hardware. Lo que sí garantizan los pesos abiertos es que nunca quedará atrapado por bloqueo tecnológico, abusos de precios o retirada abrupta de soporte —lo cual tiene un valor inherente, incluso si nunca llega a descargarlos.
¿Cuánto cuesta la API de DeepSeek?
Los precios de la API de DeepSeek van desde 0,168 USD por cada millón de tokens combinados en DeepSeek V4-Flash hasta 0,830 USD en DeepSeek R1. La tarifa combinada asume una proporción de 4:1 entre tokens de entrada y salida. Los tokens de entrada y salida se facturan por separado, siendo siempre los de salida los más caros.
¿Cuál es el modelo más económico de DeepSeek?
DeepSeek V4-Flash, a 0,140 USD por cada millón de tokens de entrada y 0,280 USD por cada millón de tokens de salida. Una carga de trabajo mensual de un equipo pequeño —20 millones de tokens de entrada y 5 millones de tokens de salida— cuesta aproximadamente 4,20 USD.
¿Cuánto cuesta DeepSeek al mes?
Con 20 millones de tokens de entrada y 5 millones de tokens de salida al mes, DeepSeek V4-Flash cuesta unos 4,20 USD y DeepSeek R1 unos 21 USD. Un proyecto secundario con 1 millón / 0,25 millones de tokens cuesta una fracción mínima de eso. Utilice la calculadora de costos de APIs de IA para estimar sus propios volúmenes.
¿Es DeepSeek más barato que Mistral AI?
En precios de entrada, DeepSeek comienza en 0,168 USD por cada millón de tokens combinados, mientras que Mistral AI comienza en 0,0220 USD para Mistral 7B. Mistral AI representa el punto de entrada más económico, aunque su capacidad difiere: compárelos ambos en el leaderboard antes de cambiar.
¿Por qué DeepSeek cobra más por los tokens de salida que por los de entrada?
Los requisitos de hardware son la razón. V4-Pro necesita aproximadamente 800 GB de VRAM en cuantización de 4 bits: una
operación centrada en centros de datos que requiere ocho GPU H100 de 80 GB o más. R1 necesita alrededor de 400 GB. V4-Flash necesita unos
140 GB, es decir, dos GPU H100 de 80 GB. Solo la versión destilada de R1, con 40 GB, cabe en el hardware que realmente adquiriría un equipo pequeño.
Frente a unos precios de API tan bajos, el autohospedaje debe superar una alta barrera: solo resulta rentable cuando su volumen de uso es lo suficientemente alto como para mantener ese hardware ocupado de forma continua, y el punto de equilibrio se desplaza cada vez que DeepSeek reduce sus precios. Calcúlelo usted mismo según su volumen personal de tokens en la
antes de comprometerse con la adquisición de hardware. Lo que sí garantizan los pesos abiertos es que nunca quedará atrapado por una dependencia exclusiva del proveedor, ni será víctima de prácticas abusivas de fijación de precios ni quedará abandonado debido a una obsolescencia —lo cual tiene un valor inherente, incluso si nunca llega a descargarlos.
¿Cuánto cuesta la API de DeepSeek?
Los precios de la API de DeepSeek oscilan entre 0,168 USD por cada millón de tokens combinados en DeepSeek V4-Flash y 0,830 USD en DeepSeek R1. La tarifa combinada asume una proporción entrada-salida de 4:1. Las entradas y salidas se facturan por separado, y las salidas siempre tienen un coste mayor.
calculadora de autohospedaje frente a API
antes de comprometerse con el hardware. Lo que sí garantizan los pesos abiertos es que nunca quedarás
atrapado, víctima de precios abusivos o abandonado por una obsolescencia —lo cual tiene un valor incluso si
nunca los descargas.
Preguntas frecuentes
¿Cuánto cuesta la API de DeepSeek?
Los precios de la API de DeepSeek van desde 0,168 USD por cada millón de tokens combinados en DeepSeek V4-Flash hasta 0,830 USD en DeepSeek R1. La tarifa combinada asume una proporción de entrada a salida de 4:1. Las entradas y salidas se facturan por separado, y las salidas siempre tienen un costo mayor.
¿Cuál es el modelo DeepSeek más económico?
DeepSeek V4-Flash, a 0,140 USD por cada millón de tokens de entrada y 0,280 USD por cada millón de tokens de salida. Una carga de trabajo mensual para un equipo pequeño de 20 millones de tokens de entrada y 5 millones de tokens de salida cuesta aproximadamente 4,20 USD.
¿Cuánto cuesta DeepSeek al mes?
Con 20 millones de tokens de entrada y 5 millones de tokens de salida al mes, DeepSeek V4-Flash cuesta aproximadamente 4,20 USD y DeepSeek R1 unos 21 USD. Un proyecto secundario con 1 millón de tokens de entrada y 0,25 millones de tokens de salida cuesta una fracción muy pequeña de esa cantidad. Utilice la calculadora de costos de la API de IA para sus propios volúmenes.
¿Es DeepSeek más barato que Mistral AI?
En los precios de nivel de entrada, DeepSeek comienza en 0,168 USD por cada millón de tokens combinados (input + output), mientras que Mistral AI comienza en 0,0220 USD por cada millón de tokens en Mistral 7B. Mistral AI representa el punto de entrada más económico, aunque las capacidades difieren: compárelos ambos en el leaderboard antes de cambiar.
¿Por qué DeepSeek cobra más por los tokens de salida que por los de entrada?
Los tokens de salida se generan uno a uno y no pueden agruparse (batched) como sí puede hacerse con un prompt, por lo que su procesamiento resulta más costoso. Por eso, las cargas de trabajo intensivas en prompts —como la recuperación de información o la clasificación— son mucho más económicas que las centradas en la generación, y por eso el precio combinado resulta más relevante que el precio publicitario de entrada.
Los precios indicados corresponden a las tarifas oficiales publicadas para la API principal de cada modelo y se actualizan conforme los proveedores las modifiquen. No incluyen descuentos por volumen, procesamiento por lotes (batch) ni caché de entradas. Última revisión: agosto de 2026.

