Ninguna empresa ha hecho más para redefinir la economía de la IA que DeepSeek. A principios de 2025 sorprendió a la industria al igualar a los modelos punteros con una fracción de su costo; a mediados de 2026, con DeepSeek V4, ocupa el primer puesto en los rankings de modelos de pesos abiertos mientras cobra una décima parte de lo que cobran los laboratorios estadounidenses. Este es el panorama completo: quién es DeepSeek, qué ofrece realmente V4 y los argumentos sinceros a favor y en contra de construir sobre él.
Conclusiones clave
- DeepSeek V4 (abril de 2026) es un modelo MoE (Mixture-of-Experts) de 1,6 billones de parámetros con pesos abiertos bajo la permisiva licencia MIT.
- Mejor relación rendimiento-precio en IA: ~$0.44/$0.87 per million tokens — 5-10x cheaper than GPT-5.5 or Claude Opus 4.8.
- Programación de clase puntera: 80,6 % en SWE-bench Verificado y 93,5 en LiveCodeBench — competitivo con los mejores modelos occidentales.
- Contexto de 1 millón de tokens y una recuperación realista y sólida en contextos largos.
- Advertencias: los datos transitan por China mediante la API alojada; la moderación de contenidos refleja la normativa china. El alojamiento propio de los pesos abiertos evita ambos problemas.
- ¿Quién es DeepSeek?
- Qué es realmente DeepSeek V4
- Los precios que redefinieron el mercado
- Benchmarks: ¿es realmente bueno?
- Donde DeepSeek destaca
- Donde DeepSeek queda atrás — advertencias sinceras
- DeepSeek frente al resto del sector
- Ventajas e inconvenientes
- Cómo acceder a DeepSeek
- Qué se necesita para autoalojar DeepSeek V4
- Preguntas frecuentes
- Conclusión
- Artículos relacionados
¿Quién es DeepSeek?
DeepSeek es un laboratorio de IA con sede en Hangzhou, escindido de High-Flyer, un fondo de cobertura cuantitativo fundado por Liang Wenfeng. Ese origen es relevante: High-Flyer ya había acumulado miles de GPU para operaciones cuantitativas, y DeepSeek heredó tanto el hardware como una cultura de ingeniería obsesionada con la eficiencia. Mientras los laboratorios estadounidenses competían por gastar más, la característica distintiva de DeepSeek se convirtió en hacer más con menos —una filosofía que dio lugar a modelos entrenados con una fracción del presupuesto de sus competidores.
Los lanzamientos de DeepSeek en 2025 (V3 y el modelo de razonamiento R1) fueron el momento en que Occidente comprendió que los modelos chinos de pesos abiertos no estaban años atrás, sino apenas meses, y avanzando rápidamente. V4 es la continuación de esa trayectoria.
What DeepSeek V4 actually is
DeepSeek V4 se lanzó el 24 de abril de 2026 como dos modelos de pesos abiertos:
- V4-Pro — un modelo MoE (Mixture-of-Experts) de 1,6 billones de parámetros con 49 000 millones de parámetros activos por token. Este es el modelo insignia.
- V4-Flash — una versión más ligera de 284 000 millones de parámetros MoE con 13 000 millones activos, diseñada para servir con alto rendimiento y bajo costo.
Ambos admiten una ventana de contexto de 1 millón de tokens y se distribuye bajo la licencia MIT, lo que significa que puedes descargar los pesos desde Hugging Face, ajustarlos finamente y desplegarlos comercialmente sin restricciones ni regalías. Esa apertura es precisamente el punto estratégico central: DeepSeek regala el modelo y compite en precio de inferencia y marca.
Los precios que redefinieron el mercado
Este es el titular. A partir de un cambio de precio permanente en mayo de 2026, la API de DeepSeek cuesta aproximadamente 0,44 USD por millón de tokens de entrada y 0,87 USD por millón de tokens de salida para el modelo Pro. V4-Flash es una orden de magnitud más económico aún (~0,10 USD / 0,20 USD).
Para situarlo en perspectiva:
| Modelos | Entrada por millón | Salida por millón | Pesos abiertos |
|---|---|---|---|
| DeepSeek V4-Pro | ~$0.44 | ~$0.87 | Sí (MIT) |
| GPT-5.5 | ~$1.25 | ~$10 | No |
| Claude Opus 4.8 | ~$5 | ~$25 | No |
| Gemini 3.5 Flash | ~$0.30 | ~$2.50 | No |
Para un equipo que procesa millones de tokens diarios mediante un agente, la diferencia entre DeepSeek y Claude Opus equivale a la diferencia entre un presupuesto de hobby y un rubro serio de infraestructura.
Benchmarks: ¿es realmente bueno?
El bajo costo no importa si la calidad de la salida es deficiente. DeepSeek V4 no es deficiente. Benchmarks independientes y de los propios proveedores sitúan a V4-Pro-Max en:
- 80,6 % en SWE-bench Verified — tareas reales de ingeniería de software, competitivo con los modelos occidentales de vanguardia.
- 93,5 en LiveCodeBench — sólida capacidad de programación bajo pruebas resistentes a la contaminación.
- 83,5 en MRCR 1M needle-in-a-haystack retrieval — actually surpassing Gemini 3.1 Pro on academic long-context benchmarks.
El patrón en 2026: DeepSeek ya no es simplemente «bueno para su precio». En programación y manejo de largo contexto, es sencillamente excelente, y su precio es un beneficio adicional.
Donde DeepSeek destaca
1. Coste por unidad de inteligencia
Ningún otro modelo se acerca a esta relación calidad-precio. Si tu carga de trabajo implica muchos tokens —agentes de programación, procesamiento de documentos o recuperación aumentada (RAG) sobre grandes corpus—, DeepSeek transforma lo que es económicamente viable.
2. Pesos abiertos bajo licencia MIT
Puedes alojarlo tú mismo. Para industrias reguladas, entornos aislados (air-gapped) o cualquier usuario que prefiera no enviar sus datos a un tercero, la posibilidad de ejecutar V4 en tu propio hardware (o en una nube neutral) resulta decisiva. La licencia MIT es la más permisiva bajo la que se ha lanzado hasta ahora un modelo de vanguardia.
3. Largo contexto funcional
La ventana de 1 millón de tokens no es solo un número de ficha técnica. Las puntuaciones de recuperación en MRCR demuestran que V4 aprovecha efectivamente su contexto, lo cual es crucial para razonamientos a escala de bases de código completas y análisis de documentos extensos.
Donde DeepSeek queda atrás — advertencias sinceras
1. Residencia de datos en la API alojada
Si usas la API oficial de DeepSeek (en lugar de un proveedor occidental o autoalojamiento), tus prompts se enrutan a través de servidores ubicados en China y quedan sujetos a la legislación china. Para muchas startups esto carece de relevancia; pero para empresas con requisitos estrictos de soberanía de datos, constituye un impedimento insalvable. La solución alternativa es realista: como los pesos están licenciados bajo MIT, puedes ejecutar V4 a través de un proveedor occidental (Together, Fireworks, OpenRouter) o en tu propia infraestructura, manteniendo así los datos completamente fuera de China.
2. Moderación de contenidos según normas chinas
Al igual que todos los modelos alojados en China, la implementación oficial de DeepSeek restringe temas políticamente sensibles conforme a las regulaciones chinas. Los pesos abiertos autoalojados se comportan de forma distinta, pero la API alojada rechazará o desviará ciertos temas. Tenlo en cuenta antes de construir un producto sobre este endpoint alojado.
3. Herramientas y ecosistema menos pulidos
El ecosistema para desarrolladores de DeepSeek — SDK, documentación, integraciones — está mejorando rápidamente, pero aún queda atrás respecto a OpenAI y Anthropic. Estás intercambiando pulcritud por precio.
DeepSeek frente al resto del sector
| Dimensión | DeepSeek V4 | Qwen3.7 Max | Kimi K2.6 | GPT-5.5 |
|---|---|---|---|---|
| Relación precio-rendimiento | Clase mundial | Bueno | Muy buena | Costoso |
| Pesos abiertos | Sí (MIT) | No (Max) | Sí | No |
| Programación (SWE-bench) | 80.6% | Fuerte | 80.2% | Fuerte |
| Ventana de contexto | 1 millón | 1 millón | 262 K | 400 K |
| Madurez del ecosistema | En mejora | Bueno | En mejora | Mejor |
Ventajas e inconvenientes
Ventajas de DeepSeek
- Relación precio-rendimiento inigualable a calidad de vanguardia
- Pesos totalmente abiertos bajo licencia MIT — autoalojables
- Capacidad de programación y manejo de largo contexto de vanguardia
- Ventana de contexto de 1 millón de tokens que funciona realmente
- Obligó a toda la industria a reducir sus precios
Desventajas de DeepSeek
- Las rutas de la API alojada transfieren los datos a través de China
- La moderación de contenidos refleja las regulaciones chinas
- Las herramientas para desarrolladores son menos pulidas que las de los laboratorios estadounidenses
- Preocupaciones sobre la marca y la confianza para algunas empresas
Cómo acceder a DeepSeek
- API alojada: platform.deepseek.com — la más económica, pero los datos pasan por China.
- Proveedores occidentales: Together AI, Fireworks y OpenRouter alojan los pesos abiertos — residencia de datos en Occidente a un costo ligeramente superior.
- Autohospedaje: Descargue los pesos de la versión V4 desde Hugging Face (licencia MIT) y ejecútelos en sus propias GPU o en una nube neutral. Es la mejor opción para privacidad y cumplimiento normativo.
- Aplicación para consumidores: la aplicación y el sitio web de chat de DeepSeek para uso ocasional.
Qué se necesita para autoalojar DeepSeek V4
El término «pesos abiertos» sugiere «se ejecuta en mi PC gamer». No es así. DeepSeek V4 se distribuye en dos variantes abiertas lanzadas en abril de 2026, y la brecha de hardware entre ellas es enorme. El punto de partida honesto: ambas son modelos de mezcla de expertos (Mixture-of-Experts), lo que tiene una consecuencia contraintuitiva. Solo una fracción de los parámetros se activa por cada token, pero todos los pesos de los expertos deben permanecer residentes en la VRAM. El recuento de parámetros activos indica la velocidad, no la cantidad de memoria que necesita adquirir.
| Variante | Parámetros totales / activos | Huella local realista |
|---|---|---|
| V4-Flash | 284B / 13B | ~170 GB en precisión nativa; ~90–100 GB con cuantización INT4 comunitaria |
| V4-Pro | 1,6T / 49B | ~860 GB en precisión nativa — exclusivamente para clústeres |
V4-Pro no está pensado para uso doméstico. Con aproximadamente 860 GB solo para los pesos, requiere un nodo multi-GPU (por ejemplo, 8 aceleradores de clase H200) o varios nodos interconectados. A menos que sea un laboratorio o una startup con financiación, trate a Pro como un modelo accesible únicamente mediante API.
V4-Flash es la variante autoalojable, aunque incluso esta exige recursos considerables. En su punto de control nativo FP4+FP8 requiere unos 170 GB de VRAM —un par de tarjetas para centros de datos como las H200, o aproximadamente cuatro A100 de 80 GB. Una cuantización agresiva INT4 comunitaria reduce este requisito a cerca de 90–100 GB, lo que permite alojarlo en una configuración de cuatro RTX 4090 para uso interno con baja concurrencia. Algunas personas lo ejecutan en dos tarjetas de consumo, pero espere lotes muy pequeños, contextos cortos y un rendimiento de tipo prototipo, no apto para una API de producción.
Para la prestación de servicios, vLLM es el estándar: entiende la paralelización por expertos y el comportamiento de la caché KV de V4, y su paralelización tensorial prefiere cantidades de GPU potencias de dos (2, 4, 8). El contexto de 1 millón de tokens es real, pero requiere memoria adicional para la caché KV; por tanto, dimensione su sistema según la longitud real de contexto que necesite, no según el máximo teórico.
La pregunta decisiva rara vez es «¿puedo ejecutarlo?», sino «¿debería hacerlo?». La API alojada de DeepSeek es tan económica que el autohospedaje solo resulta más barato en términos de coste cuando se requiere un uso sostenido y de alto volumen. Por debajo de ese umbral, lo que realmente adquiere es algo que la API no puede ofrecerle: el control sobre sus datos. Ejecútelo usted mismo cuando la privacidad o el aislamiento físico (air-gapping) sean requisitos imprescindibles; en cualquier otro caso, la API casi siempre constituye la opción más económica y rápida.
Preguntas frecuentes
¿Es seguro usar DeepSeek?
Para trabajos no sensibles, sí. Para datos sensibles o regulados, evite la API alojada en China y opte por autoalojar los pesos abiertos o utilizar un proveedor occidental. El modelo en sí no es malware; la preocupación radica únicamente en la ruta de los datos y la jurisdicción aplicable.
¿Es realmente gratuito DeepSeek?
Los pesos son gratuitos (licencia MIT); solo paga por la capacidad computacional si los autoaloja. La API alojada tiene un costo, aunque es extremadamente bajo (~0,44 $/0,87 $ por millón de tokens). También existe una aplicación gratuita de chat para consumidores.
¿Es DeepSeek mejor que ChatGPT?
En relación precio-rendimiento, claramente sí. En cuanto a capacidad fronteriza bruta y pulcritud del ecosistema, GPT-5.5 sigue liderando. Para tareas de programación y cargas de trabajo sensibles al costo, DeepSeek suele ser la opción más inteligente; para razonamiento altamente exigente y herramientas más completas, GPT-5.5 sigue siendo superior.
¿Puedo ejecutar DeepSeek sin conexión?
Sí: ese es precisamente el propósito de los pesos abiertos. V4-Flash (284B) se ejecuta en una estación de trabajo multi-GPU de gama alta; V4-Pro (1,6T) requiere hardware muy potente, pero puede autoalojarse por organizaciones con la infraestructura adecuada.
¿Censura DeepSeek sus respuestas?
La API alojada en China restringe temas políticamente sensibles conforme a las regulaciones chinas. Los pesos abiertos autoalojados se comportan de forma más abierta. Este es el aspecto más importante que debe comprender antes de desarrollar sobre el punto final alojado.
¿Quién posee DeepSeek?
DeepSeek es un laboratorio de IA con sede en Hangzhou, surgido de High-Flyer, un fondo de cobertura cuantitativo chino fundado por Liang Wenfeng. Este origen en un fondo de cobertura le proporcionó tanto un gran clúster preexistente de GPU como una cultura de ingeniería obsesionada con la eficiencia —una razón fundamental por la cual sus modelos son tan económicos de ejecutar.
¿Está prohibido DeepSeek en Estados Unidos o Europa?
No existe ninguna prohibición general para consumidores en 2026, pero varios gobiernos y grandes organizaciones han restringido la aplicación alojada de DeepSeek en dispositivos oficiales debido a preocupaciones sobre la residencia de los datos: los datos procesados por la API alojada en China están sujetos a la legislación china. Los pesos abiertos no se ven afectados: puede ejecutarlos en su propio hardware o en un proveedor occidental sin dichas preocupaciones, lo cual es la vía recomendada para usos sensibles.
¿Qué hardware necesito para ejecutar DeepSeek V4 localmente?
Depende completamente de la variante. V4-Pro (1,6 billones de parámetros) requiere un clúster multi-GPU con aproximadamente 860 GB de VRAM y no es realista para usuarios individuales. V4-Flash (284 mil millones de parámetros) es la opción autohospedable: alrededor de 170 GB de VRAM en precisión nativa, o cerca de 90–100 GB con una cuantización INT4 agresiva; esto implica una configuración multi-tarjeta orientada a centros de datos, o bien una caja con cuatro tarjetas RTX 4090 para cargas de trabajo internas ligeras. Al tratarse de un modelo Mixture-of-Experts (mezcla de expertos), todos los pesos de los expertos deben residir en memoria, aunque solo una pequeña fracción se active por cada token.
¿Es más económico autohospedar DeepSeek o usar su API?
Para casi todos los usuarios, la API es más económica. Los precios de la API alojada de DeepSeek son tan bajos que la compra y operación de GPUs solo resultan rentables con volúmenes sostenidos y muy elevados de tokens —típicamente cientos de millones de tokens por mes—. La verdadera razón para optar por el autohospedaje no es el ahorro de costes, sino el control: mantener los datos en sus propios servidores, cumplir con normativas de conformidad o ejecutar el modelo completamente sin conexión. Si ninguno de estos requisitos aplica, la opción predeterminada debe ser la API.
¿Cuál es la diferencia entre DeepSeek V4-Pro y V4-Flash?
Son dos versiones distintas de la misma generación. V4-Pro es la versión insignia de 1,6 billones de parámetros (49 mil millones activos por token), diseñada para ofrecer la máxima capacidad y ejecutarse en clústeres. V4-Flash es una versión más ligera de 284 mil millones de parámetros (13 mil millones activos), mucho más económica de desplegar, más rápida y la única que un pequeño equipo puede autohospedar de forma realista. Ambos comparten el diseño Mixture-of-Experts y la ventana de contexto de 1 millón de tokens, por lo que, para muchas tareas, Flash ofrece la mayor parte del valor a una fracción del costo en hardware.
Conclusión
DeepSeek es la fuerza más importante en la fijación de precios de la IA hoy en día. DeepSeek V4 ofrece un rendimiento fronterizo sobresaliente en programación y manejo de contextos largos, se distribuye como pesos completamente abiertos bajo licencia MIT y cuesta una fracción de cualquier modelo fronterizo occidental. Para los desarrolladores que valoran el costo —y eso incluye a la mayoría—, ignorarlo se ha vuelto imposible.
Las advertencias son reales, pero manejables: evite la API alojada en China para datos sensibles mediante el autoalojamiento o utilizando un proveedor occidental, y comprenda el comportamiento de moderación de contenidos antes de lanzar su producto. Si lo hace, DeepSeek V4 es, posiblemente, el mejor valor en inteligencia artificial en 2026 —y la señal más clara de que la era en la que los laboratorios estadounidenses cobraban precios premium por capacidades fronterizas ha llegado a su fin.

