Gemini 3.6 Flash — Spezifikationen
Compiled by Mustafa Ihsan from the vendor’s published documentation · Last updated
| Entwickler | |
|---|---|
| Typ | Schnell / allgemein |
| Modality | Text, Vision, Audio |
| Parameter | Nicht offengelegt |
| Kontextfenster | 1 Mio. |
| Maximale Ausgabe | 64 K |
| Lizenz | Proprietär |
| Offene Gewichte | Nein |
| Veröffentlicht | 2026-07 |
| Eingabepreis | $1.50 /1M |
| Ausgabepreis | $7.50 /1M |
| API-Anbieter | Google AI Studio, Vertex AI |
Was ist Gemini 3.6 Flash?
Gemini 3.6 Flash ist Googles neuestes Modell der Flash-Stufe, das am 21. Juli 2026 mit einem
Kontext von 1 Mio. Token und Preisgestaltung von 1,50 USD pro Million Tokens für Eingaben bzw. 7,50 USD pro Million Tokens für Ausgaben. Um ein verbreitetes
Suche: Es gibt kein Gemini 4 – Stand Juli 2026 ist Gemini 3.6 Flash die aktuellste Version von Gemini
Gemini 3.6 Flash – Preise: API-Kosten pro 1 Mio. Tokens
Gegenüber Gemini 3.5 Flash bleibt der Eingabepreis unverändert bei 1,50 USD, während der Ausgabepreis von 9 USD fällt
Günstigere Alternativen zu Gemini 3.6 Flash
Workloads, das ist eine direkte Einsparung, ohne dass damit Einbußen bei der Funktionalität verbunden wären
Gemini 3.6 Flash kostet 1,50 $ pro 1 Mio. Eingabetokens und 7,50 $ pro 1 Mio. Ausgabetokens. Bei einer typischen Mischung von 4:1 (Eingabe zu Ausgabe) ergibt sich ein Durchschnittspreis von rund 2,70 $ pro 1 Mio. Tokens.
Der Unterschied wird sich bei abrufintensiven Workloads mit vielen Prompts nicht bemerkbar machen, da die Eingaberate
Eine Arbeitslast eines kleinen Teams mit 20 Mio. Eingabe- und 5 Mio. Ausgabetokens pro Monat kostet bei Gemini 3.6 Flash etwa 68 $. Ein Nebenprojekt (1 Mio. Eingabe- / 0,25 Mio. Ausgabetokens) kostet ungefähr 3,38 $.
Welche günstigere Alternative zu Gemini 3.6 Flash gibt es?
Behandlung von Prompts mit mehr als 200.000 Token vor der Entwicklung einer Funktion für den gesamten Kontext
Kann ich Gemini 3.6 Flash lokal ausführen?
Nein. Gemini 3.6 Flash ist ein geschlossenes, rein API-basiertes Modell – die Gewichte werden nicht veröffentlicht, weshalb ein Self-Hosting nicht möglich ist.
| Eingabe (pro 1 Mio. Token) | $1.50 |
|---|---|
| Ausgabe (pro 1 Mio. Token) | $7.50 |
| Verhältnis Output/Input | 5× |
| Gemischt (4:1 Input:Output) | $2.70 pro 1 Mio. Tokens |
Warum berechnet Gemini 3.6 Flash für Ausgabetokens höhere Kosten als für Eingabetokens?
Tatsächliche monatliche Ausgaben bei einem 4:1-Input-zu-Output-Mix – dem Verhältnis, das typische Chat- oder RAG-Arbeitslasten tatsächlich erzeugen.
| Workload | Tokens/Monat | Kosten pro Monat |
|---|---|---|
| Nebenprojekt | 1 Mio. Eingabe / 0,25 Mio. Ausgabe | $3.38 |
| Kleines Team | 20 Mio. Eingabe / 5 Mio. Ausgabe | $68 |
| Produktion | 200 Mio. Eingabe / 50 Mio. Ausgabe | $675 |
Stellen Sie Ihre eigenen Berechnungen im KI-API-Kostenrechner.
Ausgabetokens werden einzeln generiert und können nicht wie ein Prompt gebündelt werden, weshalb sie für den Anbieter teurer sind. Gemini 3.6 Flash berechnet dafür das Fünffache – deshalb sind eingabehaltige Workloads deutlich günstiger als generierungsintensive.
| Modell | Gewichteter Preis pro Million US-Dollar | Sie sparen |
|---|---|---|
| Mistral 7B offenere | $0.0220 | 99 % günstiger |
| Llama 3.1 8B offenere | $0.0220 | 99 % günstiger |
| Mistral NeMo 12B offenere | $0.0240 | 99 % günstiger |
Häufig gestellte Fragen
Wie viel kostet Gemini 3.6 Flash pro 1 Mio. Tokens?
Gemini 3.6 Flash kostet 1,50 USD pro 1 Mio. Eingabetokens und 7,50 USD pro 1 Mio. Ausgabetokens. Bei einer typischen Mischung von 4:1 (Eingabe zu Ausgabe) ergibt sich ein effektiver Preis von rund 2,70 USD pro 1 Mio. Tokens.
Wie viel kostet Gemini 3.6 Flash monatlich?
Eine Arbeitslast eines kleinen Teams mit 20 Mio. Eingabe- und 5 Mio. Ausgabetokens pro Monat kostet bei Gemini 3.6 Flash etwa 68 USD. Ein Nebenprojekt (1 Mio. Eingabe- / 0,25 Mio. Ausgabetokens) kostet ungefähr 3,38 USD.
Was ist eine günstigere Alternative zu Gemini 3.6 Flash?
Mistral 7B ist die leistungsstärkste günstigere Option in unserer Datenbank mit 0,0220 USD pro 1 Mio. gemischten Tokens – das entspricht etwa 99 % weniger als Gemini 3.6 Flash. Außerdem handelt es sich um ein Open-Weight-Modell, sodass Self-Hosting möglich ist.
Kann ich Gemini 3.6 Flash lokal ausführen?
Nein. Gemini 3.6 Flash ist ein geschlossenes Modell, das ausschließlich über eine API verfügbar ist – die Gewichte werden nicht veröffentlicht, daher ist ein Self-Hosting nicht möglich.
Warum berechnet Gemini 3.6 Flash für Ausgabetokens höhere Kosten als für Eingabetokens?
Ausgabetokens werden einzeln generiert und können nicht wie ein Prompt gebündelt werden, weshalb sie für den Anbieter teurer sind. Gemini 3.6 Flash berechnet für Ausgabetokens das Fünffache – deshalb sind arbeitslastintensive Aufgaben mit vielen Eingabetokens deutlich günstiger als solche mit hohem Generierungsaufwand.
Vergleichen Sie alle Gemini-Modelle nebeneinander nach Preis: Preise für die Gemini-API.
Die Preise entsprechen den offiziell veröffentlichten Listenpreisen für die primäre API des jeweiligen Modells und werden regelmäßig aktualisiert, sobald Anbieter diese ändern. Volumen-, Batch- und Cached-Input-Rabatte sind nicht enthalten. Vergleichen Sie alle Modelle nebeneinander im Datenbank für KI-Modelle oder das LLM-Leaderboard.
