Tuesday, 25 August 2026 | Updating Daily AI insight, written for builders

Gemini 2.5 Pro

Gemini 2.5 Pro — Spezifikationen

EntwicklerGoogle (Google DeepMind)
TypLLM (Spitzen-Reasoning / Denken)
ModalityText, Bild, Audio, Video, PDF → Text
ParameterNicht offengelegt
Kontextfenster1 Mio. (1.048.576 Tokens)
Maximale Ausgabe64K (65.536 Tokens)
LizenzProprietär
Offene GewichteNein
VeröffentlichtMärz 2025 (Preview); 17. Juni 2025 (GA)
Eingabepreis$1.25 /1M
Ausgabepreis$10 /1M
API-AnbieterGoogle AI Studio (Gemini-API), Vertex AI, OpenRouter

Offizielle Seite →

Gemini 2.5 Pro ist Googles DeepMind-Flaggschiff-Modell der „Denk“-Klasse aus der 2.5-Generation, das speziell darauf ausgelegt ist, Probleme vor der Beantwortung systematisch durchzudenken. Es debütierte am 25. März 2025 als experimenteller Preview und erreichte am 17. Juni 2025 die allgemeine Verfügbarkeit (General Availability), wobei es sich rasch als Benchmark-Führer im Bereich Programmierung, Mathematik und Reasoning über lange Kontexte etablierte.

Sein herausragendes Merkmal ist ein nativer 1.048.576-Token (~1 Mio.) umfassendes Kontextfenster in Kombination mit vollständig multimodalen Eingaben – Text, Bilder, Audio, Video und PDFs – sowie Textausgaben mit bis zu 65.536 Tokens. Adaptive ‚Denkbudgets‘ ermöglichen Entwicklern, Latenz und Kosten gegen tiefere Reasoning-Kapazitäten einzutauschen. Das Modell wird über Google AI Studio, die Gemini-API und Vertex AI bereitgestellt; Drittanbieterzugriff erfolgt über OpenRouter.

Die Preise staffeln sich nach Prompt-Größe: 1,25 $ pro Million Eingabetokens bis zu 200.000 Tokens, danach steigen sie auf 2,50 $; für Ausgabetokens betragen sie 10 $ bzw. 15 $.

Fazit: Gemini 2.5 Pro bleibt eine der stärksten Wertoptionen unter den Spitzen-Reasoning-Modellen – ein echtes multimodales Kontextfenster mit einer Kapazität von 1 Mio. Tokens zu mittleren Preisen. Es handelt sich um ein geschlossenes Modell mit ausschließlich API-basierter Nutzung; für die Analyse langer Dokumente, agentenbasierte Programmierung und Mixed-Media-Workloads ist es jedoch kaum zu schlagen. Neuere Gemini-3.x-Modelle haben es inzwischen abgelöst, doch Gemini 2.5 Pro bleibt weit verbreitet und gut unterstützt.

Gemini 2.5 Pro – Preis pro 1 Mio. Tokens (API)

Eingabe (pro 1 Mio. Token)$1.25
Ausgabe (pro 1 Mio. Token)$10.00
Verhältnis Output/Input
Gemischt (4:1 Input:Output)$3.00 pro 1 Mio. Tokens

Was kostet Gemini 2.5 Pro monatlich?

Tatsächliche monatliche Ausgaben bei einem 4:1-Input-zu-Output-Mix – dem Verhältnis, das typische Chat- oder RAG-Arbeitslasten tatsächlich erzeugen.

WorkloadTokens/MonatKosten pro Monat
Nebenprojekt1 Mio. Eingabe / 0,25 Mio. Ausgabe$3.75
Kleines Team20 Mio. Eingabe / 5 Mio. Ausgabe$75
Produktion200 Mio. Eingabe / 50 Mio. Ausgabe$750

Stellen Sie Ihre eigenen Berechnungen im KI-API-Kostenrechner.

Günstigere Alternativen zu Gemini 2.5 Pro

ModellGewichteter Preis pro Million US-DollarSie sparen
Mistral 7B offenere$0.022099 % günstiger
Llama 3.1 8B offenere$0.022099 % günstiger
Mistral NeMo 12B offenere$0.024099 % günstiger

Häufig gestellte Fragen

Wie viel kostet Gemini 2.5 Pro pro 1 Mio. Tokens?

Gemini 2.5 Pro kostet 1,25 $ pro 1 Mio. Eingabetokens und 10,00 $ pro 1 Mio. Ausgabetokens. Bei einem typischen Verhältnis von 4:1 (Eingabe zu Ausgabe) ergibt sich ein gemischter Durchschnittspreis von rund 3,00 $ pro 1 Mio. Tokens.

Wie viel kostet Gemini 2.5 Pro monatlich?

Eine Arbeitslast eines kleinen Teams mit 20 Mio. Eingabe- und 5 Mio. Ausgabetokens pro Monat kostet bei Gemini 2.5 Pro etwa 75 $. Ein Nebenprojekt (1 Mio. Eingabe- / 0,25 Mio. Ausgabetokens) kostet ungefähr 3,75 $.

Was ist eine günstigere Alternative zu Gemini 2.5 Pro?

Mistral 7B ist die leistungsstärkste günstigere Option in unserer Datenbank mit 0,0220 $ pro 1 Mio. gemischter Tokens – also etwa 99 % weniger als Gemini 2.5 Pro. Zudem ist es open-weight, sodass auch ein Self-Hosting möglich ist.

Kann ich Gemini 2.5 Pro lokal ausführen?

Nein. Gemini 2.5 Pro ist ein geschlossenes Modell mit ausschließlich API-basierter Nutzung – die Gewichte werden nicht veröffentlicht, daher ist kein Self-Hosting möglich.

Warum verlangt Gemini 2.5 Pro für Ausgabetokens höhere Gebühren als für Eingabetokens?

Ausgabetokens werden einzeln generiert und können nicht wie ein Prompt gebündelt werden, weshalb sie für den Anbieter teurer sind. Gemini 2.5 Pro verlangt für Ausgabetokens das Achtfache – deshalb sind Workloads mit hohem Prompt-Anteil deutlich günstiger als solche mit starkem Generierungsaufwand.

Vergleichen Sie alle Gemini-Modelle nebeneinander nach Preis: Preise für die Gemini-API.

Die Preise entsprechen den offiziell veröffentlichten Listenpreisen für die primäre API des jeweiligen Modells und werden regelmäßig aktualisiert, sobald Anbieter diese ändern. Volumen-, Batch- und Cached-Input-Rabatte sind nicht enthalten. Vergleichen Sie alle Modelle nebeneinander im Datenbank für KI-Modelle oder das LLM-Leaderboard.

Scroll to Top
Featured on There's An AI For That