Mientras DeepSeek acapara los titulares, Qwen de Alibaba ha construido discretamente la familia de modelos más completa en inteligencia artificial: desde modelos diminutos para dispositivos móviles hasta un modelo insignia que, en mayo de 2026, se convirtió en el modelo chino mejor posicionado de la historia en los principales índices independientes de inteligencia. Si DeepSeek es el disruptor, Qwen es la plataforma. A continuación explicamos qué es y por qué resulta relevante.
Conclusiones clave
- Qwen3.7 Max (mayo de 2026) obtuvo una puntuación de 56,6 en el Índice de Inteligencia Artificial Analysis, ubicándose entre los 10 mejores a nivel mundial y alcanzando la puntuación más alta jamás registrada para un modelo chino.
- La familia de modelos más amplia en IA: desde modelos para dispositivos con 0,5 mil millones de parámetros hasta modelos insignia con 1 billón de parámetros, tanto de código abierto como propietarios.
- Contexto de 1 millón de tokens en el modelo insignia, con la función de razonamiento extendido activada por defecto.
- Líder en modelos de código abierto: Alibaba compite con Meta como el mayor contribuyente de modelos con licencias permisivas.
- Advertencia: los modelos insignia Max superiores son propietarios y solo accesibles mediante API; además, aplican restricciones sobre residencia de datos y moderación en el servicio alojado.
- ¿Quién es Qwen?
- El modelo insignia: Qwen3.7 Max
- La verdadera historia: la familia de modelos de pesos abiertos
- En qué destaca Qwen
- En qué queda rezagado Qwen —las advertencias sinceras
- Qwen frente al resto del sector
- Ventajas e inconvenientes
- Cómo acceder a Qwen
- ¿Qué modelo Qwen debería ejecutar realmente en su hardware?
- Preguntas frecuentes
- Conclusión
- Artículos relacionados
¿Quién es Qwen?
Qwen (abreviatura de «Tongyi Qianwen», 通义千问) es la familia de modelos de lenguaje grande desarrollada por Alibaba Cloud, el proveedor de servicios en la nube más grande de China. A diferencia de DeepSeek (un laboratorio especializado) o Moonshot (una startup), Qwen cuenta con el respaldo integral de un conglomerado valorado en billones de dólares: la infraestructura de Alibaba Cloud, la escala de sus datos comerciales y un mandato explícito para convertir a Qwen en la capa de IA predeterminada en todo el ecosistema de Alibaba y en el mundo del software de código abierto.
Ese respaldo se manifiesta en amplitud. Qwen no es un único modelo, sino una extensa familia que abarca texto, visión, audio, programación, matemáticas e incrustaciones (embeddings), con tamaños que van desde modelos submilmillonarios capaces de ejecutarse en un teléfono móvil hasta modelos insignia con billones de parámetros. Alibaba ha liberado una parte enorme de esta familia bajo licencias de código abierto, convirtiendo a Qwen, junto con Llama de Meta, en uno de los dos pilares fundamentales del ecosistema global de modelos de código abierto.
El modelo insignia: Qwen3.7 Max
Lanzado el 19 de mayo de 2026, Qwen3.7 Max es el modelo más potente de Alibaba y un auténtico hito para la inteligencia artificial china:
- 56,6 en el Índice de Inteligencia Artificial de Artificial Analysis —una posición entre los diez mejores a nivel mundial y la más alta alcanzada por cualquier modelo chino en ese benchmark independiente.
- 92,4 en GPQA Diamond (ciencias a nivel de posgrado) y 97,1 en HMMT febrero de 2026 (matemáticas competitivas) —la más alta dentro de su grupo comparativo.
- Contexto de 1 millón de tokens con razonamiento extendido habilitado de forma predeterminada.
- Precios de 2,50 USD de entrada / 7,50 USD de salida por cada millón de tokens, con entrada en caché a 0,25 USD.
El predecesor, Qwen3.6 Max (abril de 2026), sigue disponible a un costo menor (~1,04 USD/6,24 USD). Ambos son modelos propietarios y se ofrecen a través de Alibaba Cloud Model Studio, OpenRouter y Together AI.
La verdadera historia: la familia de modelos de pesos abiertos
El modelo insignia Max acapara los titulares de los benchmarks, pero el arma estratégica de Qwen es su catálogo de modelos de pesos abiertos. Alibaba ha publicado decenas de modelos Qwen bajo licencias permisivas (principalmente Apache 2.0), que abarcan:
- Modelos de texto densos y MoE desde 0,5 mil millones hasta cientos de miles de millones de parámetros.
- Qwen-VL modelos de visión-lenguaje.
- Qwen-Coder modelos ajustados específicamente para ingeniería de software.
- Qwen-Audio y modelos de incrustación (embeddings).
Esto es relevante porque convierte a Qwen en la base sobre la que se construyen miles de productos derivados y ajustes finos en todo el mundo. Si has usado un modelo de pesos abiertos fabricado en China que no fuera de DeepSeek, muy probablemente era una variante derivada de Qwen. Para los desarrolladores que desean tener control total sobre su pila tecnológica —ajustar finamente, alojar de forma independiente y prescindir de dependencias de API— Qwen ofrece más opciones en cuanto a tamaño y capacidad que cualquier competidor.
En qué destaca Qwen
1. Amplitud de la familia: desde el borde hasta la vanguardia
Ningún otro proveedor cubre todo este espectro tan bien. Puedes prototipar con la API de Qwen3.7 Max de 1 billón de parámetros y luego desplegar una versión ajustada finamente de 7 mil millones de parámetros en tu propio hardware, manteniéndote dentro de la misma familia de modelos, con comportamiento y tokenización coherentes. Esta coherencia resulta genuinamente valiosa para equipos productivos.
2. Profundidad de los modelos de pesos abiertos
El compromiso de Alibaba con los pesos abiertos rivaliza con el de Meta. Para cualquiera que desarrolle sobre modelos alojados localmente, el catálogo de Qwen es la oferta más amplia disponible —y sus licencias son compatibles con usos comerciales.
3. Fortaleza multilingüe y multimodal
Entrenado con los vastos datos multilingües y del comercio electrónico de Alibaba, Qwen destaca especialmente en chino, inglés y docenas de otros idiomas, además de poseer capacidades avanzadas en visión y audio. Para cargas de trabajo no inglesas y multimodales, suele ser la mejor opción abierta disponible.
En qué queda rezagado Qwen —las advertencias sinceras
1. Los mejores modelos son cerrados
El Qwen3.7 Max, que acapara los titulares, es propietario y solo está disponible mediante API. Si eliges la IA china precisamente por su apertura, la cúspide de la gama Qwen no cumple ese requisito: debes recurrir a los modelos abiertos de la siguiente categoría (que siguen siendo excelentes).
2. Advertencias sobre datos y moderación en las API alojadas
La API de Model Studio se ejecuta sobre la infraestructura de Alibaba Cloud en China, con las mismas consideraciones sobre residencia de datos y moderación de contenidos que otros servicios alojados en China. Alojar localmente los pesos abiertos evita este problema.
3. Fragmentación
La amplitud de la familia también representa una debilidad: con tantos modelos y versiones, elegir el Qwen adecuado para una tarea determinada requiere investigación. No existe una única respuesta tipo «simplemente usa este» como ocurre con laboratorios centrados en un solo modelo.
Qwen frente al resto del sector
| Dimensión | Qwen | DeepSeek V4 | Llama (Meta) | GPT-5.5 |
|---|---|---|---|---|
| Amplitud de la familia de modelos | Más amplia (borde → vanguardia) | Estrecha | Amplia | Estrecha |
| Profundidad de los modelos de pesos abiertos | Más profunda | Fuerte (MIT) | Profunda | Ninguna |
| Inteligencia en el extremo superior | Entre los diez mejores a nivel mundial | Fuerte | Por detrás de la vanguardia | Frontier |
| Multilingüe/multimodal | Excelente | Bueno | Bueno | Excelente |
| ¿Es el mejor modelo abierto? | No (máximo cerrado) | Sí | Sí | No |
Ventajas e inconvenientes
Ventajas de Qwen
- Familia de modelos más amplia en IA: desde el borde hasta la vanguardia
- Catálogo de pesos abiertos más profundo (licencia Apache 2.0)
- El modelo insignia entró entre los 10 mejores del mundo en inteligencia
- Cobertura sobresaliente multilingüe y multimodal
- Avalado por la escala y fiabilidad de Alibaba Cloud
Desventajas de Qwen
- Los mejores modelos (Max) son propietarios y solo están disponibles mediante API
- La API alojada implica restricciones sobre la residencia de los datos en China
- Fragmentación dentro de la familia: es difícil elegir el modelo adecuado
- Moderación de contenidos en el servicio alojado
Cómo acceder a Qwen
- Insignia (Max): Alibaba Cloud Model Studio, OpenRouter, Together AI — únicamente mediante API.
- Modelos abiertos: Descargue Qwen3, Qwen-Coder, Qwen-VL, etc. desde Hugging Face o ModelScope y hospédelos usted mismo o ajústelos.
- Chat: La aplicación web Qwen Chat para uso ocasional.
¿Qué modelo Qwen debería ejecutar realmente en su hardware?
La ventaja práctica más importante de Qwen también es su fuente de confusión más grande: hay demasiados modelos entre los que elegir. El atajo honesto consiste en partir del hardware que posees y trabajar hacia atrás. Casi todos los tamaños de Qwen se distribuyen en formato GGUF, compatible con Ollama, LM Studio y llama.cpp, Q4_K_M cuantización Q4_K_M es la opción predeterminada adecuada para casi todos: reduce el tamaño de un modelo aproximadamente entre tres y cuatro veces respecto a la precisión completa, con tan solo una ligera pérdida de calidad. Ajuste su equipo a una categoría inferior y seleccione el modelo más grande que quepa cómodamente, dejando espacio suficiente para el contexto.
| Su hardware | Mejor Qwen para ejecutar (Q4_K_M) | Qué esperar |
|---|---|---|
| Teléfono móvil / Raspberry Pi (4–8 GB de RAM) | Modelos densos de 0,6B–4B (p. ej., un modelo pequeño de ~1,7B) | Chat y resúmenes sin conexión; un modelo de ~0,6B ocupa unos 500 MB y funciona a aproximadamente 15–25 tokens/seg |
| GPU de 8 GB (RTX 3060 / 4060) | 8B denso | Asistente general ágil, aproximadamente 40+ tokens/seg —el punto de entrada para uso serio |
| GPU de 12 GB (RTX 3060 de 12 GB / 5070) | 14B denso | Razonamiento notablemente mejor; requiere unos 11 GB totales con contexto de 8K |
| GPU de 24 GB (RTX 3090 / 4090 / 5090) | 32B denso, o un MoE de clase 30B (30B-A3B) | El punto óptimo local; calidad cercana a la vanguardia en una sola tarjeta de consumo |
| 48 GB+ o Apple Silicon de 64 GB+ | Un gran MoE, como el insignia 235B-A22B | Los modelos más capaces que puedes alojar tú mismo sin un servidor |
Dos reglas te mantendrán fuera de problemas. Primero, deja margen de maniobra: un modelo que llene exactamente tu VRAM se desbordará al cargar un indicador largo, así que reduce una categoría si trabajas con contextos extensos. Segundo, cuando la familia de pesos abiertos ofrezca una Mixture-of-Experts (MoE) en tu categoría, elígela: un modelo de 30B-A3B ofrece aproximadamente la misma calidad que un modelo denso de 30B, pero su coste de ejecución es similar al de uno de 3B, ya que solo unos 3000 millones de parámetros se activan por token. Los modelos densos son más sencillos y ligeramente más predecibles; los modelos MoE representan la opción más inteligente cuando buscas la máxima capacidad por gigabyte.
Preguntas frecuentes
¿Es Qwen propiedad de Alibaba?
Yes. Qwen is developed and owned by Alibaba Cloud, Alibaba’s cloud-computing division and China’s largest cloud provider. It carries the full backing of the trillion-dollar conglomerate, drawing on Alibaba Cloud’s infrastructure, e-commerce data, and organizational resources to train and ship the model family.
Is Qwen free and open source?
Mostly yes. Most of the Qwen family, including very capable models, is released under permissive Apache 2.0 open weights, spanning text, vision, audio, and code from 0.5B to hundreds of billions of parameters. The top-tier Qwen-Max flagship models, however, are proprietary and API-only.
What is the latest Qwen model?
Qwen3.7 Max, released May 19, 2026, is the latest flagship. It’s a sparse mixture-of-experts model with roughly 1 trillion total parameters and a 1-million-token context window, scoring 56.6 on the Artificial Analysis Intelligence Index, 92.4 on GPQA Diamond, and 97.1 on HMMT February 2026.
Qwen vs DeepSeek: which is better?
They win on different fronts. DeepSeek leads on price-performance and ships its very best model as open weights under an MIT license. Qwen wins on family breadth, multimodal and multilingual coverage, and top-end benchmark intelligence, ranking among the top-10 globally while releasing the deepest range of open-weight models.
¿Es Qwen de código abierto?
Parcialmente. La mayor parte de la familia Qwen —incluidos modelos muy capaces— se publica bajo licencia de pesos abiertos Apache 2.0. Los modelos insignia de gama alta Qwen-Max son propietarios y solo están disponibles mediante API. Por tanto, afirmar que «Qwen es de código abierto» es cierto para la familia en su conjunto, pero no para el modelo absoluto más avanzado.
¿Es Qwen mejor que DeepSeek?
Cada uno tiene fortalezas distintas. DeepSeek destaca en relación precio-rendimiento y ofrece su modelo más avanzado como pesos abiertos. Qwen sobresale en amplitud de familia, cobertura multimodal y multilingüe, y rendimiento en benchmarks de inteligencia de vanguardia (Qwen3.7 Max obtiene una posición global más alta). Para flexibilidad en autohospedaje, el catálogo de Qwen es más profundo; para un único modelo abierto excelente y económico, DeepSeek resulta más sencillo.
¿Qué significa «Qwen»?
Es la abreviatura de Tongyi Qianwen (通义千问), aproximadamente «verdad derivada de mil preguntas» —la marca de Alibaba para su familia de modelos de lenguaje grande (LLM).
¿Puedo usar Qwen con fines comerciales?
Sí: los modelos abiertos tienen principalmente licencia Apache 2.0, que permite su uso comercial. La API de Max se rige por términos comerciales estándar. Consulte siempre la tarjeta de licencia específica del modelo en Hugging Face.
¿Puede ejecutarse Qwen en un teléfono?
Los modelos Qwen más pequeños (con menos de mil millones de parámetros) están diseñados para su uso en dispositivos, incluidos teléfonos móviles y hardware periférico. Esa es precisamente una de las razones por las que la familia resulta inusualmente completa.
¿Es seguro usar Qwen?
Para trabajos no sensibles, sí. Los modelos Qwen con pesos abiertos pueden autoalojarse, manteniendo sus datos completamente bajo su control —la opción más segura. La API Qwen alojada se ejecuta en Alibaba Cloud en China, con las consideraciones habituales sobre residencia de datos y moderación de contenidos; por tanto, para datos sensibles o regulados, autoaloje los pesos abiertos o utilice un proveedor occidental.
¿Es gratuito usar Qwen?
En su mayor parte, sí: los grandes modelos Qwen con pesos abiertos son gratuitos de descargar y ejecutar bajo licencias permisivas (principalmente Apache 2.0); usted solo paga por su propia infraestructura informática. El modelo insignia de gama alta Qwen-Max es una API de pago. También existe una aplicación web gratuita Qwen Chat para uso ocasional.
¿Cuánta VRAM necesito para ejecutar Qwen localmente?
Con la cuantización estándar Q4_K_M, calcula aproximadamente 6 GB de VRAM para un modelo de 8B, unos 11 GB para uno de 14B y entre 20 y 22 GB para un modelo de 30–32B —siempre dejando varios gigabytes adicionales libres para tu ventana de contexto. Una tarjeta de 8 GB constituye el punto de entrada realista para un asistente rápido y útil; 24 GB (una RTX 3090, 4090 o 5090) representa el punto óptimo local. Por debajo de esa cifra, los modelos Qwen más pequeños siguen funcionando en la CPU de un teléfono o portátil, aunque más lentamente.
¿Qué modelo Qwen es el mejor para programación?
En cuanto a capacidad bruta, la versión especializada Qwen3-Coder (un modelo de mezcla de expertos de 480 mil millones de parámetros) es la opción más potente y compite directamente con los principales modelos cerrados de programación; sin embargo, a esa escala lo más realista es usarlo mediante una API, no en tu propia máquina. Para programación local, el modelo Qwen3-Coder 30B-A3B funciona bien con cuantización Q4_K_M en una sola GPU de 24 GB (unos 19 GB en disco) y es la opción práctica por defecto. Si dispones únicamente de una tarjeta de 8–10 GB o de un portátil de 16 GB, opta por un modelo Qwen3 pequeño y general (4B o 8B) o por el anterior Qwen2.5-Coder-7B, que sigue siendo sólido para la finalización de código. Elige el modelo especializado en programación más grande que quepa en tu hardware, no el modelo estrella por su nombre.
¿Debo ejecutar un modelo Qwen denso o uno de mezcla de expertos?
Elige un modelo denso para tamaños pequeños y máxima simplicidad: son fáciles de cuantizar, predecibles y cuentan con soporte amplio en todas partes. Opta por un modelo MoE cuando quieras la mayor capacidad por gigabyte de memoria: un modelo de mezcla de expertos activa solo una fracción de sus parámetros por token, por lo que obtienes la calidad de un modelo mucho más grande al costo de inferencia de uno pequeño. En una tarjeta de 24 GB, el modelo MoE 30B-A3B suele ser la opción más inteligente que Qwen ofrece.
Conclusión
Qwen es la fuerza menos valorada del sector de la IA china. Carece de la narrativa disruptiva de precios de DeepSeek, pero ofrece algo potencialmente más valioso: la familia de modelos más amplia, profunda y lista para producción existente, anclada por un modelo insignia que ahora compite con la vanguardia global y una larga cola de modelos abiertos que impulsan miles de productos en todo el mundo.
Si busca un único proveedor de IA capaz de llevarlo desde un modelo apto para teléfonos móviles hasta un modelo insignia entre los 10 mejores del mundo —abierto donde realmente importa, multimodal, multilingüe y respaldado por la fiabilidad de Alibaba Cloud—, Qwen constituye la respuesta más completa disponible en 2026. Solo tenga en cuenta que el mejor modelo Qwen está cerrado y que la API alojada está sujeta a las habituales limitaciones jurisdiccionales chinas. Para la mayoría de los proyectos desarrollados por la mayoría de los equipos, los modelos Qwen abiertos son más que suficientes.

