Gemini 2.5 Pro — Especificações
| Desenvolvedor | Google (Google DeepMind) |
|---|---|
| Tipo | LLM (raciocínio / pensamento de ponta) |
| Modalidade | Texto, imagem, áudio, vídeo, PDF → texto |
| Parâmetros | Não divulgado |
| Janela de contexto | 1 milhão (1.048.576 tokens) |
| Saída máxima | 64K (65.536 tokens) |
| Licença | Proprietário |
| Pesos abertos | Não |
| Lançado | Março de 2025 (versão prévia); 17 de junho de 2025 (disponibilidade geral) |
| Preço da entrada | $1.25 /1M |
| Preço da saída | $10 /1M |
| Provedores de API | Google AI Studio (API Gemini), Vertex AI, OpenRouter |
Gemini 2.5 Pro é o modelo principal de 'raciocínio' da Google DeepMind da geração 2.5, projetado para analisar problemas antes de fornecer respostas. Ele estreou como uma versão experimental em 25 de março de 2025 e atingiu a disponibilidade geral em 17 de junho de 2025, consolidando-se rapidamente como líder de referência em programação, matemática e raciocínio com contexto longo.
Seu recurso de destaque é uma janela de contexto nativa de 1.048.576 tokens (~1 milhão) associada à entrada totalmente multimodal — texto, imagens, áudio, vídeo e PDFs — e saída em texto com até 65.536 tokens. Orçamentos adaptáveis de 'raciocínio' permitem que os desenvolvedores troquem latência e custo por um raciocínio mais profundo. O modelo é disponibilizado por meio do Google AI Studio, da API Gemini e do Vertex AI, com acesso de terceiros via OpenRouter.
A precificação é escalonada conforme o tamanho do prompt: US$ 1,25 por milhão de tokens de entrada até 200K, subindo para US$ 2,50 acima desse limite, com custos de saída de US$ 10 e US$ 15, respectivamente.
Veredito: O Gemini 2.5 Pro continua sendo uma das melhores opções em termos de custo-benefício entre os modelos de raciocínio de ponta — oferecendo, de fato, um contexto multimodal de 1 milhão de tokens a um preço intermediário. Trata-se de um modelo com pesos fechados e acessível apenas por API, mas é difícil de superar em tarefas como análise de documentos extensos, programação autônoma e cargas de trabalho com múltiplos formatos de mídia. Modelos mais recentes da série Gemini 3.x agora o substituem, mas o 2.5 Pro permanece amplamente implantado e bem suportado.
Precificação do Gemini 2.5 Pro: custo da API por 1 milhão de tokens
| Entrada (por 1 milhão de tokens) | $1.25 |
|---|---|
| Saída (por 1 milhão de tokens) | $10.00 |
| Razão saída/entrada | 8× |
| Misturada (4:1 entrada:saída) | $3.00 por 1 milhão de tokens |
Quanto custa mensalmente o Gemini 2.5 Pro
Gasto mensal real com uma proporção de entrada para saída de 4:1 — a razão efetivamente gerada por cargas de trabalho típicas de chat ou RAG.
| Carga de trabalho | Tokens/mês | Custo por mês |
|---|---|---|
| Projeto paralelo | 1 milhão de tokens de entrada / 0,25 milhão de tokens de saída | $3.75 |
| Equipe pequena | 20 milhões de tokens de entrada / 5 milhões de tokens de saída | $75 |
| Produção | 200 milhões de tokens de entrada / 50 milhões de tokens de saída | $750 |
Calcule seus próprios números na Calculadora de custos de API de IA.
Alternativas mais baratas ao Gemini 2.5 Pro
| Modelo | Custo médio ponderado por US$ 1 milhão | Você economiza |
|---|---|---|
| Mistral 7B aberta | $0.0220 | 99% mais barato |
| Llama 3.1 8B aberta | $0.0220 | 99% mais barato |
| Mistral NeMo 12B aberta | $0.0240 | 99% mais barato |
Perguntas frequentes
Quanto custa o Gemini 2.5 Pro por 1 milhão de tokens?
O Gemini 2.5 Pro custa US$ 1,25 por 1 milhão de tokens de entrada e US$ 10,00 por 1 milhão de tokens de saída. Com uma proporção típica de entrada para saída de 4:1, o custo médio fica em cerca de US$ 3,00 por 1 milhão de tokens.
Quanto custa mensalmente o Gemini 2.5 Pro?
Uma carga de trabalho mensal de uma pequena equipe — 20 milhões de tokens de entrada e 5 milhões de tokens de saída — custa cerca de US$ 75 no Gemini 2.5 Pro. Um projeto paralelo (1 milhão de tokens de entrada e 0,25 milhão de tokens de saída) custa aproximadamente US$ 3,75.
Qual é uma alternativa mais barata ao Gemini 2.5 Pro?
O Mistral 7B é a opção mais barata e robusta em nossa base de dados, a US$ 0,0220 por 1 milhão de tokens combinados — cerca de 99% menos que o Gemini 2.5 Pro. Além disso, é um modelo com pesos abertos, possibilitando sua hospedagem local.
Posso executar o Gemini 2.5 Pro localmente?
Não. O Gemini 2.5 Pro é um modelo fechado, acessível exclusivamente por API — seus pesos não são divulgados, portanto não pode ser auto-hospedado.
Por que o Gemini 2.5 Pro cobra mais pelos tokens de saída do que pelos de entrada?
Os tokens de saída são gerados um por vez e não podem ser processados em lote como um prompt, tornando seu fornecimento mais custoso para o provedor. O Gemini 2.5 Pro cobra 8× mais pelos tokens de saída, razão pela qual cargas de trabalho intensivas em prompts são muito mais econômicas do que aquelas intensivas em geração.
Veja todos os modelos Gemini com preços comparados lado a lado: Preços da API Gemini.
Os preços correspondem às tarifas listadas oficialmente para a API principal do modelo e são revisados conforme os provedores os atualizam. Descontos por volume, processamento em lote ou entradas em cache não estão incluídos. Compare todos os modelos lado a lado na Banco de dados de modelos de IA ou o Ranking de LLMs.

