Monday, 10 August 2026 | Updating Daily AI insight, written for builders

DeepSeek V4-Pro versus DeepSeek V4-Flash: Especificações, preços e qual escolher (2026)

DeepSeek V4-Pro vs DeepSeek V4-FlashDeepSeekmodelo principal versus seu modelo econômico Flash. Abaixo está a comparação detalhada lado a lado: especificações, preços de API, janela de contexto, requisitos de hardware local e uma recomendação clara e baseada em dados sobre qual escolher.

EspecificaçõesDeepSeek V4-ProDeepSeek V4-Flash
DesenvolvedorDeepSeekDeepSeek
TipoLLM (MoE)LLM (MoE)
Parâmetros1,6 trilhão no total / ~49 bilhões ativos (MoE)284B no total / ~13B ativos (MoE)
Janela de contexto1 milhão1 milhão
ModalidadeTexto → TextoTexto → Texto
LicençaMIT (aberta)MIT (aberta)
Pesos abertos✅ Yes✅ Yes
Preço de entrada (US$/1 milhão)$0.435$0.14
Preço de saída (US$/1 milhão)$0.87$0.28
VRAM (4 bits)~800 GB~140 GB
GPU mínima (local)Servidor multi-GPU (ex.: 8× H100 80 GB)2× H100 80 GB (4 bits)
Lançado2026-042026-04

Principais diferenças

  • Custo: O DeepSeek V4-Flash é 211% mais barato que o DeepSeek V4-Pro com base no custo médio por token.
  • Abertura: ambos possuem pesos abertos, portanto podem ser auto-hospedados ou ajustados. Compare suas necessidades de VRAM acima para saber qual GPU pode executá-los.
  • Execute o DeepSeek V4-Pro localmente: ~~800 GB em 4 bits (servidor multi-GPU mínimo, ex.: 8× H100 80 GB).
  • Execute o DeepSeek V4-Flash localmente: ~~140 GB em 4 bits (mínimo: 2× H100 80 GB (4 bits)).

Qual você deve escolher?

Escolha o DeepSeek V4-Pro se ele se encaixar na sua pilha existente ou se você preferir a linha DeepSeek.

Escolha o DeepSeek V4-Flash se você deseja um custo menor por token para cargas de trabalho de alto volume.

→ Estime custos reais no Calculadora de custos da API · verifique o hardware local no Calculadora de VRAM · navegue por todos os 30+ modelos.

Todas as especificações e preços são obtidas em tempo real do nosso Banco de dados de modelos de IA e mantidos atualizados. Compare qualquer um desses modelos com outros ou estime seus próprios gastos mensais com as calculadoras gratuitas acima.

Escrito por Mustafa Ihsan

Mustafa Ihsan é fundador e editor do Convly.ai. Ele criou e mantém o banco de dados em tempo real de modelos de IA do site, seu índice de relação custo-desempenho, bem como suas calculadoras gratuitas para requisitos de VRAM, custos de API e economia de autohospedagem. Escreve sobre precificação de modelos, resultados de benchmarks e hardware necessário para executar modelos de IA localmente, preferindo sempre dados mensuráveis às alegações dos fabricantes.

Scroll to Top
Featured on There's An AI For That