Gemini 2.5 Pro — Spezifikationen
| Entwickler | Google (Google DeepMind) |
|---|---|
| Typ | LLM (Spitzen-Reasoning / Denken) |
| Modality | Text, Bild, Audio, Video, PDF → Text |
| Parameter | Nicht offengelegt |
| Kontextfenster | 1 Mio. (1.048.576 Tokens) |
| Maximale Ausgabe | 64K (65.536 Tokens) |
| Lizenz | Proprietär |
| Offene Gewichte | Nein |
| Veröffentlicht | März 2025 (Preview); 17. Juni 2025 (GA) |
| Eingabepreis | $1.25 /1M |
| Ausgabepreis | $10 /1M |
| API-Anbieter | Google AI Studio (Gemini-API), Vertex AI, OpenRouter |
Gemini 2.5 Pro ist Googles DeepMind-Flaggschiff-Modell der „Denk“-Klasse aus der 2.5-Generation, das speziell darauf ausgelegt ist, Probleme vor der Beantwortung systematisch durchzudenken. Es debütierte am 25. März 2025 als experimenteller Preview und erreichte am 17. Juni 2025 die allgemeine Verfügbarkeit (General Availability), wobei es sich rasch als Benchmark-Führer im Bereich Programmierung, Mathematik und Reasoning über lange Kontexte etablierte.
Sein herausragendes Merkmal ist ein nativer 1.048.576-Token (~1 Mio.) umfassendes Kontextfenster in Kombination mit vollständig multimodalen Eingaben – Text, Bilder, Audio, Video und PDFs – sowie Textausgaben mit bis zu 65.536 Tokens. Adaptive ‚Denkbudgets‘ ermöglichen Entwicklern, Latenz und Kosten gegen tiefere Reasoning-Kapazitäten einzutauschen. Das Modell wird über Google AI Studio, die Gemini-API und Vertex AI bereitgestellt; Drittanbieterzugriff erfolgt über OpenRouter.
Die Preise staffeln sich nach Prompt-Größe: 1,25 $ pro Million Eingabetokens bis zu 200.000 Tokens, danach steigen sie auf 2,50 $; für Ausgabetokens betragen sie 10 $ bzw. 15 $.
Fazit: Gemini 2.5 Pro bleibt eine der stärksten Wertoptionen unter den Spitzen-Reasoning-Modellen – ein echtes multimodales Kontextfenster mit einer Kapazität von 1 Mio. Tokens zu mittleren Preisen. Es handelt sich um ein geschlossenes Modell mit ausschließlich API-basierter Nutzung; für die Analyse langer Dokumente, agentenbasierte Programmierung und Mixed-Media-Workloads ist es jedoch kaum zu schlagen. Neuere Gemini-3.x-Modelle haben es inzwischen abgelöst, doch Gemini 2.5 Pro bleibt weit verbreitet und gut unterstützt.
Gemini 2.5 Pro – Preis pro 1 Mio. Tokens (API)
| Eingabe (pro 1 Mio. Token) | $1.25 |
|---|---|
| Ausgabe (pro 1 Mio. Token) | $10.00 |
| Verhältnis Output/Input | 8× |
| Gemischt (4:1 Input:Output) | $3.00 pro 1 Mio. Tokens |
Was kostet Gemini 2.5 Pro monatlich?
Tatsächliche monatliche Ausgaben bei einem 4:1-Input-zu-Output-Mix – dem Verhältnis, das typische Chat- oder RAG-Arbeitslasten tatsächlich erzeugen.
| Workload | Tokens/Monat | Kosten pro Monat |
|---|---|---|
| Nebenprojekt | 1 Mio. Eingabe / 0,25 Mio. Ausgabe | $3.75 |
| Kleines Team | 20 Mio. Eingabe / 5 Mio. Ausgabe | $75 |
| Produktion | 200 Mio. Eingabe / 50 Mio. Ausgabe | $750 |
Stellen Sie Ihre eigenen Berechnungen im KI-API-Kostenrechner.
Günstigere Alternativen zu Gemini 2.5 Pro
| Modell | Gewichteter Preis pro Million US-Dollar | Sie sparen |
|---|---|---|
| Mistral 7B offenere | $0.0220 | 99 % günstiger |
| Llama 3.1 8B offenere | $0.0220 | 99 % günstiger |
| Mistral NeMo 12B offenere | $0.0240 | 99 % günstiger |
Häufig gestellte Fragen
Wie viel kostet Gemini 2.5 Pro pro 1 Mio. Tokens?
Gemini 2.5 Pro kostet 1,25 $ pro 1 Mio. Eingabetokens und 10,00 $ pro 1 Mio. Ausgabetokens. Bei einem typischen Verhältnis von 4:1 (Eingabe zu Ausgabe) ergibt sich ein gemischter Durchschnittspreis von rund 3,00 $ pro 1 Mio. Tokens.
Wie viel kostet Gemini 2.5 Pro monatlich?
Eine Arbeitslast eines kleinen Teams mit 20 Mio. Eingabe- und 5 Mio. Ausgabetokens pro Monat kostet bei Gemini 2.5 Pro etwa 75 $. Ein Nebenprojekt (1 Mio. Eingabe- / 0,25 Mio. Ausgabetokens) kostet ungefähr 3,75 $.
Was ist eine günstigere Alternative zu Gemini 2.5 Pro?
Mistral 7B ist die leistungsstärkste günstigere Option in unserer Datenbank mit 0,0220 $ pro 1 Mio. gemischter Tokens – also etwa 99 % weniger als Gemini 2.5 Pro. Zudem ist es open-weight, sodass auch ein Self-Hosting möglich ist.
Kann ich Gemini 2.5 Pro lokal ausführen?
Nein. Gemini 2.5 Pro ist ein geschlossenes Modell mit ausschließlich API-basierter Nutzung – die Gewichte werden nicht veröffentlicht, daher ist kein Self-Hosting möglich.
Warum verlangt Gemini 2.5 Pro für Ausgabetokens höhere Gebühren als für Eingabetokens?
Ausgabetokens werden einzeln generiert und können nicht wie ein Prompt gebündelt werden, weshalb sie für den Anbieter teurer sind. Gemini 2.5 Pro verlangt für Ausgabetokens das Achtfache – deshalb sind Workloads mit hohem Prompt-Anteil deutlich günstiger als solche mit starkem Generierungsaufwand.
Vergleichen Sie alle Gemini-Modelle nebeneinander nach Preis: Preise für die Gemini-API.
Die Preise entsprechen den offiziell veröffentlichten Listenpreisen für die primäre API des jeweiligen Modells und werden regelmäßig aktualisiert, sobald Anbieter diese ändern. Volumen-, Batch- und Cached-Input-Rabatte sind nicht enthalten. Vergleichen Sie alle Modelle nebeneinander im Datenbank für KI-Modelle oder das LLM-Leaderboard.

