Tuesday, 25 August 2026 | Updating Daily AI insight, written for builders

Gemini 2.5 Pro

Gemini 2.5 Pro — Specifiche

SviluppatoreGoogle (Google DeepMind)
TipoLLM (ragionamento / pensiero di frontiera)
ModalitàTesto, immagine, audio, video, PDF → testo
ParametriNon divulgato
Finestra contestuale1 milione (1.048.576 token)
Output massimo64K (65.536 token)
LicenzaProprietaria
Pesi apertiNo
PubblicatoMarzo 2025 (anteprima); 17 giugno 2025 (disponibilità generale)
Prezzo dell’input$1.25 /1M
Prezzo dell’output$10 /1M
Provider APIGoogle AI Studio (API Gemini), Vertex AI, OpenRouter

Pagina ufficiale →

Gemini 2.5 Pro È il modello flagship di Google DeepMind per il «ragionamento» della generazione 2.5, progettato per analizzare i problemi prima di fornire una risposta. È stato presentato in anteprima sperimentale il 25 marzo 2025 ed è diventato disponibile a tutti il 17 giugno 2025, affermandosi rapidamente come riferimento nei settori della programmazione, della matematica e del ragionamento su contesti lunghi.

La sua caratteristica principale è una finestra di contesto nativa di 1.048.576 token (~1 milione) abbinata a un input completamente multimodale — testo, immagini, audio, video e PDF — e a un output testuale fino a 65.536 token. I budget adattivi di «ragionamento» consentono agli sviluppatori di bilanciare latenza e costo in cambio di un ragionamento più approfondito. Il modello è distribuito tramite Google AI Studio, l’API Gemini e Vertex AI, con accesso di terze parti disponibile anche tramite OpenRouter.

Il prezzo è suddiviso in base alla dimensione del prompt: 1,25 $ per milione di token in input fino a 200K, che sale a 2,50 $ oltre tale soglia; per l’output i costi sono rispettivamente di 10 $ e 15 $.

Verdetto: Gemini 2.5 Pro rimane una delle scelte più vantaggiose tra i modelli di ragionamento di frontiera: offre effettivamente una finestra di contesto multimodale da 1 milione di token a un prezzo intermedio. Si tratta di un modello con pesi chiusi e accessibile esclusivamente tramite API, ma per l’analisi di documenti lunghi, la programmazione basata su agenti e i carichi di lavoro che combinano diversi tipi di media è difficilmente superabile. Modelli più recenti della serie Gemini 3.x lo hanno ormai sostituito, tuttavia Gemini 2.5 Pro resta ampiamente utilizzato e ben supportato.

Prezzi di Gemini 2.5 Pro: costo API per 1 milione di token

Input (per ogni milione di token)$1.25
Output (per ogni milione di token)$10.00
Rapporto output/input
Combinato (4:1 in:out)$3.00 per 1 milione di token

Quanto costa Gemini 2.5 Pro al mese

Spesa mensile reale con un mix input-to-output 4:1 — il rapporto effettivamente prodotto da un tipico carico di lavoro basato su chat o RAG.

Carico di lavoroToken/meseCosto/mese
Progetto secondario1 milione in ingresso / 0,25 milioni in uscita$3.75
Piccolo team20 milioni in ingresso / 5 milioni in uscita$75
Produzione200 milioni in ingresso / 50 milioni in uscita$750

Calcola i tuoi numeri personalizzati nel Calcolatore dei costi delle API per l'IA.

Alternative più economiche a Gemini 2.5 Pro

ModelloCosto combinato ($/1 milione)Risparmi
Mistral 7B aperta$0.022099% più economico
Llama 3.1 8B aperta$0.022099% più economico
Mistral NeMo 12B aperta$0.024099% più economico

Domande frequenti

Quanto costa Gemini 2.5 Pro per 1 milione di token?

Gemini 2.5 Pro costa 1,25 $ per 1 milione di token in input e 10,00 $ per 1 milione di token in output. Con un rapporto tipico input/output di 4:1, il costo medio si attesta intorno ai 3,00 $ per 1 milione di token.

Quanto costa Gemini 2.5 Pro al mese?

Un carico di lavoro mensile di una piccola squadra — 20 milioni di token in input e 5 milioni in output — costa circa 75 $ su Gemini 2.5 Pro. Per un progetto personale (1 milione in input / 0,25 milioni in output) il costo è di circa 3,75 $.

Qual è un’alternativa più economica a Gemini 2.5 Pro?

Mistral 7B è l’opzione più economica e performante disponibile nel nostro database, a soli 0,0220 $ per 1 milione di token combinati — circa il 99 % in meno rispetto a Gemini 2.5 Pro. Inoltre è un modello open-weight, quindi è possibile ospitarlo autonomamente.

Posso eseguire Gemini 2.5 Pro localmente?

No. Gemini 2.5 Pro è un modello chiuso, accessibile esclusivamente tramite API: i suoi pesi non sono stati resi pubblici, quindi non può essere auto-ospitato.

Perché Gemini 2.5 Pro applica un costo maggiore per i token in output rispetto a quelli in input?

I token in output vengono generati uno alla volta e non possono essere elaborati in batch come invece avviene per i prompt, pertanto il loro servizio comporta costi maggiori per il fornitore. Gemini 2.5 Pro applica un costo per l’output 8 volte superiore rispetto a quello per l’input, motivo per cui i carichi di lavoro incentrati sui prompt risultano molto più economici rispetto a quelli orientati alla generazione.

Confronta i prezzi di tutti i modelli Gemini uno accanto all’altro: Prezzi dell'API Gemini.

I prezzi indicati sono le tariffe ufficiali pubblicate per l'API principale del modello e vengono aggiornati man mano che i fornitori li modificano. Sconti per volumi elevati, elaborazione batch e input memorizzati nella cache non sono inclusi. Confronta tutti i modelli fianco a fianco nel Database di modelli IA o il Classifica LLM.

Scroll to Top
Featured on There's An AI For That