Thursday, 17 September 2026 | Updating Daily AI insight, written for builders

Gemini 3.6 Flash

Gemini 3.6 Flash — Spezifikationen

Compiled by Mustafa Ihsan from the vendor’s published documentation · Last updated

Entwickler Google
Typ Schnell / allgemein
Modality Text, Vision, Audio
Parameter Nicht offengelegt
Kontextfenster 1 Mio.
Maximale Ausgabe 64 K
Lizenz Proprietär
Offene Gewichte Nein
Veröffentlicht 2026-07
Eingabepreis $1.50 /1M
Ausgabepreis $7.50 /1M
API-Anbieter Google AI Studio, Vertex AI

Offizielle Seite →

Was ist Gemini 3.6 Flash?

Gemini 3.6 Flash ist Googles neuestes Modell der Flash-Stufe, das am 21. Juli 2026 mit einem
Kontext von 1 Mio. Token und Preisgestaltung von 1,50 USD pro Million Tokens für Eingaben bzw. 7,50 USD pro Million Tokens für Ausgaben. Um ein verbreitetes
Suche: Es gibt kein Gemini 4 – Stand Juli 2026 ist Gemini 3.6 Flash die aktuellste Version von Gemini
Gemini 3.6 Flash – Preise: API-Kosten pro 1 Mio. Tokens

Gegenüber Gemini 3.5 Flash bleibt der Eingabepreis unverändert bei 1,50 USD, während der Ausgabepreis von 9 USD fällt
Günstigere Alternativen zu Gemini 3.6 Flash
Workloads, das ist eine direkte Einsparung, ohne dass damit Einbußen bei der Funktionalität verbunden wären
Gemini 3.6 Flash kostet 1,50 $ pro 1 Mio. Eingabetokens und 7,50 $ pro 1 Mio. Ausgabetokens. Bei einer typischen Mischung von 4:1 (Eingabe zu Ausgabe) ergibt sich ein Durchschnittspreis von rund 2,70 $ pro 1 Mio. Tokens.
Der Unterschied wird sich bei abrufintensiven Workloads mit vielen Prompts nicht bemerkbar machen, da die Eingaberate
Eine Arbeitslast eines kleinen Teams mit 20 Mio. Eingabe- und 5 Mio. Ausgabetokens pro Monat kostet bei Gemini 3.6 Flash etwa 68 $. Ein Nebenprojekt (1 Mio. Eingabe- / 0,25 Mio. Ausgabetokens) kostet ungefähr 3,38 $.
Welche günstigere Alternative zu Gemini 3.6 Flash gibt es?
Behandlung von Prompts mit mehr als 200.000 Token vor der Entwicklung einer Funktion für den gesamten Kontext
Kann ich Gemini 3.6 Flash lokal ausführen?

Nein. Gemini 3.6 Flash ist ein geschlossenes, rein API-basiertes Modell – die Gewichte werden nicht veröffentlicht, weshalb ein Self-Hosting nicht möglich ist.

Eingabe (pro 1 Mio. Token)$1.50
Ausgabe (pro 1 Mio. Token)$7.50
Verhältnis Output/Input
Gemischt (4:1 Input:Output)$2.70 pro 1 Mio. Tokens

Warum berechnet Gemini 3.6 Flash für Ausgabetokens höhere Kosten als für Eingabetokens?

Tatsächliche monatliche Ausgaben bei einem 4:1-Input-zu-Output-Mix – dem Verhältnis, das typische Chat- oder RAG-Arbeitslasten tatsächlich erzeugen.

WorkloadTokens/MonatKosten pro Monat
Nebenprojekt 1 Mio. Eingabe / 0,25 Mio. Ausgabe $3.38
Kleines Team 20 Mio. Eingabe / 5 Mio. Ausgabe $68
Produktion 200 Mio. Eingabe / 50 Mio. Ausgabe $675

Stellen Sie Ihre eigenen Berechnungen im KI-API-Kostenrechner.

Ausgabetokens werden einzeln generiert und können nicht wie ein Prompt gebündelt werden, weshalb sie für den Anbieter teurer sind. Gemini 3.6 Flash berechnet dafür das Fünffache – deshalb sind eingabehaltige Workloads deutlich günstiger als generierungsintensive.

ModellGewichteter Preis pro Million US-DollarSie sparen
Mistral 7B offenere $0.0220 99 % günstiger
Llama 3.1 8B offenere $0.0220 99 % günstiger
Mistral NeMo 12B offenere $0.0240 99 % günstiger

Häufig gestellte Fragen

Wie viel kostet Gemini 3.6 Flash pro 1 Mio. Tokens?

Gemini 3.6 Flash kostet 1,50 USD pro 1 Mio. Eingabetokens und 7,50 USD pro 1 Mio. Ausgabetokens. Bei einer typischen Mischung von 4:1 (Eingabe zu Ausgabe) ergibt sich ein effektiver Preis von rund 2,70 USD pro 1 Mio. Tokens.

Wie viel kostet Gemini 3.6 Flash monatlich?

Eine Arbeitslast eines kleinen Teams mit 20 Mio. Eingabe- und 5 Mio. Ausgabetokens pro Monat kostet bei Gemini 3.6 Flash etwa 68 USD. Ein Nebenprojekt (1 Mio. Eingabe- / 0,25 Mio. Ausgabetokens) kostet ungefähr 3,38 USD.

Was ist eine günstigere Alternative zu Gemini 3.6 Flash?

Mistral 7B ist die leistungsstärkste günstigere Option in unserer Datenbank mit 0,0220 USD pro 1 Mio. gemischten Tokens – das entspricht etwa 99 % weniger als Gemini 3.6 Flash. Außerdem handelt es sich um ein Open-Weight-Modell, sodass Self-Hosting möglich ist.

Kann ich Gemini 3.6 Flash lokal ausführen?

Nein. Gemini 3.6 Flash ist ein geschlossenes Modell, das ausschließlich über eine API verfügbar ist – die Gewichte werden nicht veröffentlicht, daher ist ein Self-Hosting nicht möglich.

Warum berechnet Gemini 3.6 Flash für Ausgabetokens höhere Kosten als für Eingabetokens?

Ausgabetokens werden einzeln generiert und können nicht wie ein Prompt gebündelt werden, weshalb sie für den Anbieter teurer sind. Gemini 3.6 Flash berechnet für Ausgabetokens das Fünffache – deshalb sind arbeitslastintensive Aufgaben mit vielen Eingabetokens deutlich günstiger als solche mit hohem Generierungsaufwand.

Vergleichen Sie alle Gemini-Modelle nebeneinander nach Preis: Preise für die Gemini-API.

Die Preise entsprechen den offiziell veröffentlichten Listenpreisen für die primäre API des jeweiligen Modells und werden regelmäßig aktualisiert, sobald Anbieter diese ändern. Volumen-, Batch- und Cached-Input-Rabatte sind nicht enthalten. Vergleichen Sie alle Modelle nebeneinander im Datenbank für KI-Modelle oder das LLM-Leaderboard.

Scroll to Top