Gemini 2.5 Pro — Specifiche
| Sviluppatore | Google (Google DeepMind) |
|---|---|
| Tipo | LLM (ragionamento / pensiero di frontiera) |
| Modalità | Testo, immagine, audio, video, PDF → testo |
| Parametri | Non divulgato |
| Finestra contestuale | 1 milione (1.048.576 token) |
| Output massimo | 64K (65.536 token) |
| Licenza | Proprietaria |
| Pesi aperti | No |
| Pubblicato | Marzo 2025 (anteprima); 17 giugno 2025 (disponibilità generale) |
| Prezzo dell’input | $1.25 /1M |
| Prezzo dell’output | $10 /1M |
| Provider API | Google AI Studio (API Gemini), Vertex AI, OpenRouter |
Gemini 2.5 Pro È il modello flagship di Google DeepMind per il «ragionamento» della generazione 2.5, progettato per analizzare i problemi prima di fornire una risposta. È stato presentato in anteprima sperimentale il 25 marzo 2025 ed è diventato disponibile a tutti il 17 giugno 2025, affermandosi rapidamente come riferimento nei settori della programmazione, della matematica e del ragionamento su contesti lunghi.
La sua caratteristica principale è una finestra di contesto nativa di 1.048.576 token (~1 milione) abbinata a un input completamente multimodale — testo, immagini, audio, video e PDF — e a un output testuale fino a 65.536 token. I budget adattivi di «ragionamento» consentono agli sviluppatori di bilanciare latenza e costo in cambio di un ragionamento più approfondito. Il modello è distribuito tramite Google AI Studio, l’API Gemini e Vertex AI, con accesso di terze parti disponibile anche tramite OpenRouter.
Il prezzo è suddiviso in base alla dimensione del prompt: 1,25 $ per milione di token in input fino a 200K, che sale a 2,50 $ oltre tale soglia; per l’output i costi sono rispettivamente di 10 $ e 15 $.
Verdetto: Gemini 2.5 Pro rimane una delle scelte più vantaggiose tra i modelli di ragionamento di frontiera: offre effettivamente una finestra di contesto multimodale da 1 milione di token a un prezzo intermedio. Si tratta di un modello con pesi chiusi e accessibile esclusivamente tramite API, ma per l’analisi di documenti lunghi, la programmazione basata su agenti e i carichi di lavoro che combinano diversi tipi di media è difficilmente superabile. Modelli più recenti della serie Gemini 3.x lo hanno ormai sostituito, tuttavia Gemini 2.5 Pro resta ampiamente utilizzato e ben supportato.
Prezzi di Gemini 2.5 Pro: costo API per 1 milione di token
| Input (per ogni milione di token) | $1.25 |
|---|---|
| Output (per ogni milione di token) | $10.00 |
| Rapporto output/input | 8× |
| Combinato (4:1 in:out) | $3.00 per 1 milione di token |
Quanto costa Gemini 2.5 Pro al mese
Spesa mensile reale con un mix input-to-output 4:1 — il rapporto effettivamente prodotto da un tipico carico di lavoro basato su chat o RAG.
| Carico di lavoro | Token/mese | Costo/mese |
|---|---|---|
| Progetto secondario | 1 milione in ingresso / 0,25 milioni in uscita | $3.75 |
| Piccolo team | 20 milioni in ingresso / 5 milioni in uscita | $75 |
| Produzione | 200 milioni in ingresso / 50 milioni in uscita | $750 |
Calcola i tuoi numeri personalizzati nel Calcolatore dei costi delle API per l'IA.
Alternative più economiche a Gemini 2.5 Pro
| Modello | Costo combinato ($/1 milione) | Risparmi |
|---|---|---|
| Mistral 7B aperta | $0.0220 | 99% più economico |
| Llama 3.1 8B aperta | $0.0220 | 99% più economico |
| Mistral NeMo 12B aperta | $0.0240 | 99% più economico |
Domande frequenti
Quanto costa Gemini 2.5 Pro per 1 milione di token?
Gemini 2.5 Pro costa 1,25 $ per 1 milione di token in input e 10,00 $ per 1 milione di token in output. Con un rapporto tipico input/output di 4:1, il costo medio si attesta intorno ai 3,00 $ per 1 milione di token.
Quanto costa Gemini 2.5 Pro al mese?
Un carico di lavoro mensile di una piccola squadra — 20 milioni di token in input e 5 milioni in output — costa circa 75 $ su Gemini 2.5 Pro. Per un progetto personale (1 milione in input / 0,25 milioni in output) il costo è di circa 3,75 $.
Qual è un’alternativa più economica a Gemini 2.5 Pro?
Mistral 7B è l’opzione più economica e performante disponibile nel nostro database, a soli 0,0220 $ per 1 milione di token combinati — circa il 99 % in meno rispetto a Gemini 2.5 Pro. Inoltre è un modello open-weight, quindi è possibile ospitarlo autonomamente.
Posso eseguire Gemini 2.5 Pro localmente?
No. Gemini 2.5 Pro è un modello chiuso, accessibile esclusivamente tramite API: i suoi pesi non sono stati resi pubblici, quindi non può essere auto-ospitato.
Perché Gemini 2.5 Pro applica un costo maggiore per i token in output rispetto a quelli in input?
I token in output vengono generati uno alla volta e non possono essere elaborati in batch come invece avviene per i prompt, pertanto il loro servizio comporta costi maggiori per il fornitore. Gemini 2.5 Pro applica un costo per l’output 8 volte superiore rispetto a quello per l’input, motivo per cui i carichi di lavoro incentrati sui prompt risultano molto più economici rispetto a quelli orientati alla generazione.
Confronta i prezzi di tutti i modelli Gemini uno accanto all’altro: Prezzi dell'API Gemini.
I prezzi indicati sono le tariffe ufficiali pubblicate per l'API principale del modello e vengono aggiornati man mano che i fornitori li modificano. Sconti per volumi elevati, elaborazione batch e input memorizzati nella cache non sono inclusi. Confronta tutti i modelli fianco a fianco nel Database di modelli IA o il Classifica LLM.

