Thursday, 6 August 2026 | Updating Daily AI insight, written for builders

Qwen da Alibaba em 2026: A família de modelos de IA mais completa do mundo

Atualizado · Publicado originalmente em 30 de maio de 2026

Quick answer: Yes, Qwen is owned by Alibaba, developed by its cloud division Alibaba Cloud, China's largest cloud provider. Backed by the trillion-dollar conglomerate's infrastructure and data, the Qwen family spans 0.5B to roughly 1 trillion parameters. Most models ship as Apache 2.0 open weights, while the flagship Qwen-Max models stay proprietary and API-only.

Enquanto DeepSeek chama a atenção da mídia, Qwen da Alibaba construiu silenciosamente a família de modelos mais completa em inteligência artificial — desde pequenos modelos executáveis em dispositivos até um modelo principal que, em maio de 2026, tornou-se o modelo chinês com melhor classificação de sempre em benchmarks independentes de inteligência. Se o DeepSeek é o disruptor, o Qwen é a plataforma. Veja do que se trata e por que isso importa.

Principais conclusões

  • Qwen3.7 Max (maio de 2026) obteve 56,6 pontos no Índice de Inteligência Artificial Analysis — entre os 10 melhores globalmente e a pontuação mais alta já registrada para um modelo chinês.
  • A família de modelos mais abrangente em IA: de modelos embarcados de 0,5 bilhão de parâmetros até modelos principais com 1 trilhão de parâmetros, tanto de código aberto quanto proprietários.
  • Contexto de 1 milhão de tokens no modelo principal, com o modo de raciocínio estendido ativado por padrão.
  • Líder em modelos de peso aberto: A Alibaba rivaliza com a Meta como maior contribuidora de modelos licenciados sob licenças permissivas.
  • Reserva: os modelos principais Max são proprietários e acessíveis apenas via API; aplicam-se restrições quanto à localização dos dados e à moderação no serviço hospedado.

Quem é o Qwen

Qwen (abreviação de «Tongyi Qianwen», 通义千问) é a família de modelos de linguagem grande desenvolvida pela Alibaba Cloud, o maior provedor de serviços em nuvem da China. Ao contrário do DeepSeek (um laboratório especializado) ou da Moonshot (uma startup), o Qwen conta com todo o apoio de um conglomerado avaliado em trilhões de dólares: a infraestrutura da Alibaba Cloud, a escala de dados do comércio eletrônico e o mandato de tornar o Qwen a camada de IA padrão em todo o ecossistema da Alibaba e no mundo do código aberto.

Esse respaldo traduz-se em abrangência. O Qwen não é um único modelo — é uma vasta família que abrange texto, visão, áudio, programação, matemática e incorporações (embeddings), em tamanhos que vão desde modelos com menos de um bilhão de parâmetros, capazes de rodar em smartphones, até modelos principais com um trilhão de parâmetros. A Alibaba open-sourceou uma parcela enorme dessa família, tornando o Qwen, ao lado do Llama da Meta, um dos dois pilares do ecossistema global de modelos de peso aberto.

EmpresaAlibaba Cloud (China)
Modelo principalQwen3.7 Max (19 de maio de 2026)
ArquiteturaMoE esparsa, ~1 trilhão de parâmetros totais
Janela de contexto1.000.000 de tokens (modelo principal)
Faixa da família0,5 B → 1 T de parâmetros; texto, visão, áudio, programação
LicençaMuitos modelos sob licença Apache 2.0; série Max é proprietária
Preços de modelo principal~US$ 2,50 por entrada / US$ 7,50 por saída a cada 1 milhão de tokens
Ideal paraEquipes que desejam uma única família de modelos, desde dispositivos de borda até os mais avançados

O modelo principal: Qwen3.7 Max

Lançado em 19 de maio de 2026, Qwen3.7 Max é o modelo mais capaz da Alibaba e um marco genuíno para a inteligência artificial chinesa:

  • 56,6 no Índice de Inteligência Artificial Analysis — uma colocação entre os 10 melhores globalmente e a mais alta já alcançada por qualquer modelo chinês nesse benchmark independente.
  • 92,4 no GPQA Diamond (ciências em nível de pós-graduação) e 97,1 no HMMT de fevereiro de 2026 (matemática competitiva) — o mais alto em seu grupo comparativo.
  • Contexto de 1 milhão de tokens com raciocínio estendido ativado por padrão.
  • Preço de US$ 2,50 por entrada / US$ 7,50 por saída por milhão de tokens, com entrada em cache custando US$ 0,25.

O antecessor, Qwen3.6 Max (abril de 2026), permanece disponível a um custo menor (~US$ 1,04/US$ 6,24). Ambos são modelos proprietários e disponibilizados por meio do Alibaba Cloud Model Studio, OpenRouter e Together AI.

A verdadeira história: a família de modelos de pesos abertos

O modelo principal Max atrai manchetes nos benchmarks, mas a arma estratégica do Qwen é seu catálogo de modelos de pesos abertos. A Alibaba lançou dezenas de modelos Qwen sob licenças permissivas (principalmente Apache 2.0), abrangendo:

  • Modelos textuais densos e MoE com parâmetros variando de 0,5 bilhão a centenas de bilhões.
  • Qwen-VL modelos multimodais visão-linguagem.
  • Qwen-Coder modelos ajustados especificamente para engenharia de software.
  • Qwen-Audio e modelos de incorporação (embeddings).

Isso é relevante porque torna o Qwen a base para milhares de produtos derivados e ajustes finos (fine-tunes) em todo o mundo. Se você já usou um modelo de pesos abertos desenvolvido na China que não fosse da DeepSeek, muito provavelmente era uma derivação do Qwen. Para desenvolvedores que desejam ter total controle sobre sua pilha — ajustar, hospedar localmente e dispensar dependência de APIs — o Qwen oferece mais opções de tamanho e capacidade do que qualquer concorrente.

Onde o Qwen se destaca

1. Amplitude da família — de dispositivos de borda aos modelos mais avançados

Nenhum outro fornecedor cobre todo esse espectro tão bem. Você pode fazer protótipos usando a API do Qwen 1T Max e, em seguida, implantar um modelo aberto ajustado de 7B em seu próprio hardware, permanecendo dentro da mesma família de modelos, com comportamento e tokenização consistentes. Essa coerência é realmente valiosa para equipes de produção.

2. Profundidade dos modelos de pesos abertos

O compromisso da Alibaba com pesos abertos rivaliza com o da Meta. Para quem desenvolve com modelos auto-hospedados, o catálogo do Qwen é o mais abrangente disponível — e suas licenças são comercialmente amigáveis.

3. Força multilíngue e multimodal

Treinado com os vastos dados multilíngues e de comércio eletrônico da Alibaba, o Qwen apresenta desempenho excepcional em chinês, inglês e dezenas de outros idiomas, além de suporte robusto para visão e áudio. Para cargas de trabalho não anglófonas e multimodais, é frequentemente a melhor opção aberta disponível.

Onde o Qwen perde — ressalvas honestas

1. Os melhores modelos são fechados

O Qwen3.7 Max, que lidera as manchetes, é proprietário e acessível apenas por API. Se sua razão para escolher IA chinesa for justamente sua abertura, o topo da linha Qwen não atende a esse critério — você precisa recorrer aos modelos abertos de nível inferior (ainda excelentes).

2. Ressalvas sobre dados e moderação nas APIs hospedadas

A API do Model Studio opera na infraestrutura da Alibaba Cloud na China, com as mesmas considerações sobre residência de dados e moderação de conteúdo aplicáveis a outros serviços hospedados na China. Hospedar localmente os modelos de pesos abertos evita essa limitação.

3. Fragmentação

A amplitude da família também é uma fraqueza: com tantos modelos e versões, escolher o Qwen certo para uma tarefa exige pesquisa. Não há uma única resposta definitiva do tipo 'basta usar este aqui', como ocorre com laboratórios que oferecem apenas um modelo.

Qwen versus a concorrência

DimensãoQwenDeepSeek V4Llama (Meta)GPT-5.5
Amplitude da família de modelosA mais ampla (de borda → fronteira)RestritaAmplaRestrita
Profundidade dos modelos de pesos abertosA mais profundaForte (licença MIT)ProfundaNenhum
Inteligência de pontaEntre os 10 melhores globalmenteFortesAtrás da fronteiraFrontier
Multilíngue/multimodalExcelenteBomBomExcelente
Melhor modelo aberto?Não (máximo fechado)SimSimNão

Vantagens e desvantagens

Pontos fortes do Qwen

  • Família de modelos mais abrangente em IA — desde dispositivos de borda até o estado-da-arte
  • Catálogo de modelos de código aberto mais profundo (licença Apache 2.0)
  • O modelo principal (flagship) entrou no top 10 global em inteligência
  • Cobertura multilíngue e multimodal excepcional
  • Apoiado pela escala e confiabilidade da Alibaba Cloud

Pontos fracos do Qwen

  • Os melhores modelos (Max) são proprietários e disponíveis apenas por API
  • A API hospedada impõe restrições quanto à residência de dados na China
  • Fragmentação da família — difícil escolher o modelo certo
  • Moderação de conteúdo no serviço hospedado

Como acessar o Qwen

  • Modelo principal (Max): Alibaba Cloud Model Studio, OpenRouter, Together AI — somente via API.
  • Modelos abertos: Baixe o Qwen3, Qwen-Coder, Qwen-VL etc. do Hugging Face / ModelScope e hospede-os localmente ou faça fine-tuning.
  • Chat: Aplicativo web Qwen Chat para uso casual.

Qual Qwen você deve realmente executar em seu hardware?

A maior vantagem prática do Qwen é também sua maior fonte de confusão: há muitos modelos para escolher. O atalho honesto é começar a partir do hardware que você possui e trabalhar no sentido inverso. Quase todos os tamanhos de Qwen estão disponíveis no formato GGUF, esperado por Ollama, LM Studio e llama.cpp, e o Q4_K_M quantização é a configuração padrão adequada para quase todos — reduz o tamanho de um modelo cerca de três a quatro vezes em comparação com a precisão total, com apenas uma pequena perda de qualidade. Combine seu equipamento com um nível inferior e escolha o maior modelo que caiba confortavelmente, deixando espaço suficiente para o contexto.

Seu hardwareMelhor Qwen para executar (Q4_K_M)O que esperar
Smartphone / Raspberry Pi (4–8 GB de RAM)Modelos densos de 0,6B a 4B (ex.: um modelo pequeno de ~1,7B)Conversação e resumo offline; um modelo de ~0,6B tem cerca de 500 MB e opera a aproximadamente 15–25 tokens/seg
GPU com 8 GB (RTX 3060 / 4060)Modelo denso de 8BAssistente geral ágil, com cerca de 40+ tokens/seg — ponto de entrada para uso sério
GPU com 12 GB (RTX 3060 12GB / 5070)Modelo denso de 14BRaciocínio perceptivelmente superior; requer cerca de 11 GB no total para contexto de 8K
GPU com 24 GB (RTX 3090 / 4090 / 5090)Modelo denso de 32B ou um MoE de classe 30B (30B-A3B)Ponto ideal local; qualidade próxima ao estado-da-arte em uma única placa consumidora
48 GB+ ou Apple Silicon com 64 GB+Um grande MoE, como o modelo principal 235B-A22BOs modelos mais capazes que você pode hospedar localmente sem um servidor

Duas regras o mantêm fora de problemas. Primeiro, deixe uma margem de segurança: um modelo que preencha exatamente sua VRAM transbordará assim que você carregar um prompt longo; portanto, reduza um nível se trabalhar com contextos extensos. Segundo, quando a família de pesos abertos oferecer uma Mixture-of-Experts (MoE) opção em seu nível, escolha-a — um modelo 30B-A3B oferece aproximadamente a mesma qualidade de um modelo denso de 30B, mas custa cerca de tanto para executar quanto um modelo denso de 3B, pois apenas cerca de 3 bilhões de parâmetros são ativados por token. Os modelos densos são mais simples e ligeiramente mais previsíveis; os modelos MoE representam a escolha mais inteligente quando se busca capacidade máxima por gigabyte.

Perguntas frequentes

Sim.

Yes. Qwen is developed and owned by Alibaba Cloud, Alibaba’s cloud-computing division and China’s largest cloud provider. It carries the full backing of the trillion-dollar conglomerate, drawing on Alibaba Cloud’s infrastructure, e-commerce data, and organizational resources to train and ship the model family.

Is Qwen free and open source?

Mostly yes. Most of the Qwen family, including very capable models, is released under permissive Apache 2.0 open weights, spanning text, vision, audio, and code from 0.5B to hundreds of billions of parameters. The top-tier Qwen-Max flagship models, however, are proprietary and API-only.

What is the latest Qwen model?

Qwen3.7 Max, released May 19, 2026, is the latest flagship. It’s a sparse mixture-of-experts model with roughly 1 trillion total parameters and a 1-million-token context window, scoring 56.6 on the Artificial Analysis Intelligence Index, 92.4 on GPQA Diamond, and 97.1 on HMMT February 2026.

Qwen vs DeepSeek: which is better?

They win on different fronts. DeepSeek leads on price-performance and ships its very best model as open weights under an MIT license. Qwen wins on family breadth, multimodal and multilingual coverage, and top-end benchmark intelligence, ranking among the top-10 globally while releasing the deepest range of open-weight models.

O Qwen é de código aberto?

Parcialmente. A maior parte da família Qwen — incluindo modelos muito capazes — é disponibilizada sob licença de pesos abertos Apache 2.0. Os modelos principais de ponta (Qwen-Max) são proprietários e acessíveis apenas por API. Portanto, afirmar que "o Qwen é de código aberto" é verdadeiro para a família como um todo, mas não para o modelo absoluto mais avançado.

O Qwen é melhor que o DeepSeek?

Forças distintas. O DeepSeek se destaca em relação custo-desempenho e disponibiliza seu melhor modelo como pesos abertos. Já o Qwen se destaca pela amplitude da família, cobertura multimodal/multilíngue e desempenho nos principais benchmarks de inteligência (o Qwen3.7 Max ocupa posição mais alta globalmente). Para flexibilidade de hospedagem local, o catálogo do Qwen é mais amplo; para um único modelo aberto excelente e econômico, o DeepSeek é mais simples.

O que significa "Qwen"?

É uma abreviação de Tongyi Qianwen (通义千问), aproximadamente "verdade proveniente de mil perguntas" — marca da Alibaba para sua família de modelos de linguagem grande (LLM).

Posso usar o Qwen comercialmente?

Sim — os modelos abertos têm, na maioria, licença Apache 2.0, que permite uso comercial. A API do Qwen-Max segue termos comerciais padrão. Verifique sempre o cartão de licença específico do modelo no Hugging Face.

O Qwen roda em um smartphone?

Os menores modelos Qwen (abaixo de um bilhão de parâmetros) foram projetados para uso em dispositivos embarcados, incluindo smartphones e hardware de borda. Isso faz parte do que torna essa família incomumente completa.

O Qwen é seguro para uso?

Para trabalhos não sensíveis, sim. Os modelos Qwen de pesos abertos podem ser hospedados localmente, mantendo seus dados totalmente sob seu controle — a opção mais segura. A API hospedada do Qwen opera na infraestrutura da Alibaba Cloud na China, com as considerações habituais sobre residência de dados e moderação de conteúdo; portanto, para dados sensíveis ou regulamentados, opte por hospedar localmente os pesos abertos ou use um provedor ocidental.

O Qwen é gratuito para uso?

Na maior parte, sim — os grandes modelos Qwen de pesos abertos são gratuitos para download e execução sob licenças permissivas (na maioria, Apache 2.0); você paga apenas pelos seus próprios recursos computacionais. O modelo principal de ponta Qwen-Max é uma API paga. Há também um aplicativo web gratuito Qwen Chat para uso casual.

Quanta VRAM é necessária para executar o Qwen localmente?

Na quantização padrão Q4_K_M, planeje cerca de 6 GB de VRAM para um modelo de 8B, aproximadamente 11 GB para um de 14B e cerca de 20–22 GB para um modelo de 30–32B — sempre reservando alguns gigabytes extras para sua janela de contexto. Uma placa de 8 GB é o ponto de entrada realista para um assistente rápido e útil; 24 GB (como nas RTX 3090, 4090 ou 5090) representa o ponto ideal para execução local. Abaixo disso, os menores modelos Qwen ainda funcionam em um smartphone ou na CPU de um laptop, embora mais lentamente.

Qual modelo Qwen é o melhor para programação?

Para capacidade bruta, o modelo especializado Qwen3-Coder (um modelo Mixture-of-Experts de 480B de parâmetros) é a opção mais forte e compete diretamente com os principais modelos fechados voltados para programação — porém, nessa escala, você o utiliza realisticamente por meio de uma API, não em sua própria máquina. Para programação local, o modelo Qwen3-Coder 30B-A3B roda bem na quantização Q4_K_M em uma única GPU de 24 GB (ocupando cerca de 19 GB no disco) e é a escolha prática padrão. Se você dispõe apenas de uma placa de 8–10 GB ou de um laptop com 16 GB, opte por um modelo Qwen3 pequeno e geral (4B ou 8B) ou pelo antigo Qwen2.5-Coder-7B, que ainda é sólido para conclusão de código. Escolha o maior modelo especializado em programação compatível com seu hardware, em vez do modelo de destaque mais divulgado.

Devo executar um modelo Qwen denso ou um Mixture-of-Experts?

Escolha um modelo denso para tamanhos pequenos e máxima simplicidade — eles são fáceis de quantizar, previsíveis e amplamente suportados em todos os lugares. Opte por um modelo MoE quando desejar a maior capacidade por gigabyte de memória: um modelo Mixture-of-Experts ativa apenas uma fração de seus parâmetros por token, permitindo-lhe obter a qualidade de um modelo muito maior ao custo computacional de inferência de um modelo pequeno. Em uma placa de 24 GB, o MoE 30B-A3B frequentemente representa a escolha mais inteligente entre todos os modelos Qwen disponíveis.

Conclusão

O Qwen é a força menos valorizada da IA chinesa. Embora não tenha a narrativa disruptiva de preços do DeepSeek, oferece algo potencialmente mais valioso: a família de modelos mais ampla, profunda e pronta para produção existente, ancorada por um modelo principal que agora compete com os modelos de ponta globais e por uma longa cauda de modelos abertos que impulsionam milhares de produtos em todo o mundo.

Se você busca um único fornecedor de IA capaz de atendê-lo desde um modelo para smartphones até um modelo principal entre os dez melhores do mundo — aberto onde realmente importa, multimodal, multilíngue e apoiado pela confiabilidade da Alibaba Cloud — o Qwen é a solução mais completa disponível em 2026. Basta saber que o melhor modelo Qwen é fechado e que a API hospedada está sujeita às restrições habituais de jurisdição chinesa. Para a maior parte do que a maioria das equipes desenvolve, os modelos Qwen abertos são mais do que suficientes.

Escrito por Mustafa Ihsan

Mustafa Ihsan é fundador e editor do Convly.ai. Ele criou e mantém o banco de dados em tempo real de modelos de IA do site, seu índice de desempenho por preço e suas calculadoras gratuitas para requisitos de VRAM, custos de API e economia de autohospedagem. Escreve sobre precificação de modelos, resultados de benchmarks e hardware necessário para executar modelos de IA localmente, preferindo consistentemente dados mensuráveis às declarações dos fornecedores.

Scroll to Top
Featured on There's An AI For That