Tuesday, 25 August 2026 | Updating Daily AI insight, written for builders

Gemini 2.5 Pro

Gemini 2.5 Pro — Especificações

DesenvolvedorGoogle (Google DeepMind)
TipoLLM (raciocínio / pensamento de ponta)
ModalidadeTexto, imagem, áudio, vídeo, PDF → texto
ParâmetrosNão divulgado
Janela de contexto1 milhão (1.048.576 tokens)
Saída máxima64K (65.536 tokens)
LicençaProprietário
Pesos abertosNão
LançadoMarço de 2025 (versão prévia); 17 de junho de 2025 (disponibilidade geral)
Preço da entrada$1.25 /1M
Preço da saída$10 /1M
Provedores de APIGoogle AI Studio (API Gemini), Vertex AI, OpenRouter

Página oficial →

Gemini 2.5 Pro é o modelo principal de 'raciocínio' da Google DeepMind da geração 2.5, projetado para analisar problemas antes de fornecer respostas. Ele estreou como uma versão experimental em 25 de março de 2025 e atingiu a disponibilidade geral em 17 de junho de 2025, consolidando-se rapidamente como líder de referência em programação, matemática e raciocínio com contexto longo.

Seu recurso de destaque é uma janela de contexto nativa de 1.048.576 tokens (~1 milhão) associada à entrada totalmente multimodal — texto, imagens, áudio, vídeo e PDFs — e saída em texto com até 65.536 tokens. Orçamentos adaptáveis de 'raciocínio' permitem que os desenvolvedores troquem latência e custo por um raciocínio mais profundo. O modelo é disponibilizado por meio do Google AI Studio, da API Gemini e do Vertex AI, com acesso de terceiros via OpenRouter.

A precificação é escalonada conforme o tamanho do prompt: US$ 1,25 por milhão de tokens de entrada até 200K, subindo para US$ 2,50 acima desse limite, com custos de saída de US$ 10 e US$ 15, respectivamente.

Veredito: O Gemini 2.5 Pro continua sendo uma das melhores opções em termos de custo-benefício entre os modelos de raciocínio de ponta — oferecendo, de fato, um contexto multimodal de 1 milhão de tokens a um preço intermediário. Trata-se de um modelo com pesos fechados e acessível apenas por API, mas é difícil de superar em tarefas como análise de documentos extensos, programação autônoma e cargas de trabalho com múltiplos formatos de mídia. Modelos mais recentes da série Gemini 3.x agora o substituem, mas o 2.5 Pro permanece amplamente implantado e bem suportado.

Precificação do Gemini 2.5 Pro: custo da API por 1 milhão de tokens

Entrada (por 1 milhão de tokens)$1.25
Saída (por 1 milhão de tokens)$10.00
Razão saída/entrada
Misturada (4:1 entrada:saída)$3.00 por 1 milhão de tokens

Quanto custa mensalmente o Gemini 2.5 Pro

Gasto mensal real com uma proporção de entrada para saída de 4:1 — a razão efetivamente gerada por cargas de trabalho típicas de chat ou RAG.

Carga de trabalhoTokens/mêsCusto por mês
Projeto paralelo1 milhão de tokens de entrada / 0,25 milhão de tokens de saída$3.75
Equipe pequena20 milhões de tokens de entrada / 5 milhões de tokens de saída$75
Produção200 milhões de tokens de entrada / 50 milhões de tokens de saída$750

Calcule seus próprios números na Calculadora de custos de API de IA.

Alternativas mais baratas ao Gemini 2.5 Pro

ModeloCusto médio ponderado por US$ 1 milhãoVocê economiza
Mistral 7B aberta$0.022099% mais barato
Llama 3.1 8B aberta$0.022099% mais barato
Mistral NeMo 12B aberta$0.024099% mais barato

Perguntas frequentes

Quanto custa o Gemini 2.5 Pro por 1 milhão de tokens?

O Gemini 2.5 Pro custa US$ 1,25 por 1 milhão de tokens de entrada e US$ 10,00 por 1 milhão de tokens de saída. Com uma proporção típica de entrada para saída de 4:1, o custo médio fica em cerca de US$ 3,00 por 1 milhão de tokens.

Quanto custa mensalmente o Gemini 2.5 Pro?

Uma carga de trabalho mensal de uma pequena equipe — 20 milhões de tokens de entrada e 5 milhões de tokens de saída — custa cerca de US$ 75 no Gemini 2.5 Pro. Um projeto paralelo (1 milhão de tokens de entrada e 0,25 milhão de tokens de saída) custa aproximadamente US$ 3,75.

Qual é uma alternativa mais barata ao Gemini 2.5 Pro?

O Mistral 7B é a opção mais barata e robusta em nossa base de dados, a US$ 0,0220 por 1 milhão de tokens combinados — cerca de 99% menos que o Gemini 2.5 Pro. Além disso, é um modelo com pesos abertos, possibilitando sua hospedagem local.

Posso executar o Gemini 2.5 Pro localmente?

Não. O Gemini 2.5 Pro é um modelo fechado, acessível exclusivamente por API — seus pesos não são divulgados, portanto não pode ser auto-hospedado.

Por que o Gemini 2.5 Pro cobra mais pelos tokens de saída do que pelos de entrada?

Os tokens de saída são gerados um por vez e não podem ser processados em lote como um prompt, tornando seu fornecimento mais custoso para o provedor. O Gemini 2.5 Pro cobra 8× mais pelos tokens de saída, razão pela qual cargas de trabalho intensivas em prompts são muito mais econômicas do que aquelas intensivas em geração.

Veja todos os modelos Gemini com preços comparados lado a lado: Preços da API Gemini.

Os preços correspondem às tarifas listadas oficialmente para a API principal do modelo e são revisados conforme os provedores os atualizam. Descontos por volume, processamento em lote ou entradas em cache não estão incluídos. Compare todos os modelos lado a lado na Banco de dados de modelos de IA ou o Ranking de LLMs.

Scroll to Top
Featured on There's An AI For That