Friday, 7 August 2026 | Updating Daily AI insight, written for builders

Grok-API-Preise (2026): Was kosten die Modelle von xAI pro 1 Mio. Tokens?

Die Grok-API kostet 3 US-Dollar pro 1 Mio. Eingabetokens und 15 US-Dollar pro 1 Mio. Ausgabetokens bei Grok 4,
– was bei einer typischen Nutzungsmischung einem gemischten Satz von rund 5,40 US-Dollar entspricht. Damit positioniert sich xAI auf gleicher Höhe mit den Spitzenmodellen von OpenAI und Anthropic, nicht jedoch im Budgetsegment – eine strategische Entscheidung, die bestimmt, wann Grok die richtige Wahl ist und wann nicht.
eine Positionierungsentscheidung, die festlegt, wann Grok die richtige Wahl ist und wann nicht.
eine Positionierungsentscheidung, die festlegt, wann Grok die richtige Wahl ist und wann nicht.

Grok-API-Preise: Alle Modelle im Überblick, pro 1 Mio. Tokens

ModellEingabe $/1 Mio.Ausgabe $/1 Mio.Gewichteter Preis pro Million US-DollarKontext
Grok 4$3.00$15.00$5.40256.000 Tokens

‚Gemischt‘ bezeichnet den effektiven Satz bei einem typischen Verhältnis von vier Eingabe- zu einem Ausgabetoken – genau das erzeugt eine typische Chat- oder Retrieval-Workload tatsächlich. Dieser Wert ist der entscheidende Vergleichsmaßstab zwischen Anbietern; ein reiner Eingabepreis verschleiert hingegen die Kostenseite der Ausgabe.

Wie viel kostet Grok monatlich?

WorkloadTokens/MonatGrok 4
Nebenprojekt1 Mio. Eingabe / 0,25 Mio. Ausgabe$6.75
Kleines Team20 Mio. Eingabe / 5 Mio. Ausgabe$135
Produktion200 Mio. Eingabe / 50 Mio. Ausgabe$1,350

Modellieren Sie Ihre eigenen Volumina im KI-API-Kostenrechner.

Wie schneidet Grok im Vergleich zu anderen Anbietern ab?

Das jeweils günstigste Modell jedes Anbieters, sodass der Vergleich hinsichtlich der Eintrittskosten ‚Apples-to-Apples‘ erfolgt.

AnbieterGünstigstes ModellGewichteter Preis pro Million US-Dollar
Mistral AIMistral 7B$0.0220
MetaLlama 3.1 8B$0.0220
AlibabaQwen3 8B$0.0600
GoogleGemma 3 4B$0.0600
MicrosoftPhi-4$0.0840
DeepSeekDeepSeek V4-Flash$0.168
Moonshot AIKimi K2.7 Code$0.980
AnthropicClaude Haiku 4.5$1.80
Zhipu AIGLM 5.2$2.00
xAI dieser SeiteGrok 4$5.40
OpenAIGPT-5.6 Sol$10.00

Das günstigste Modell ist nicht automatisch das beste Preis-Leistungs-Verhältnis – prüfen Sie daher stets auch die Leistungsfähigkeit neben dem Preis auf der LLM-Leaderboard, oder durchsuchen Sie sämtliche Modelle in der Datenbank für KI-Modelle.

Was erhalten Sie für diesen Preis?

Grok 4 wurde am 9. Juli 2025 als xAIs Flaggschiff-Reasoning-Modell und Nachfolger von
Grok 3 vorgestellt. Es kombiniert natives Chain-of-Thought-Reasoning mit multimodalem Verständnis, akzeptiert
Text- und Bild-Eingaben und gibt ausschließlich Text zurück; zudem verfügt es über ein Kontextfenster von 256.000 Token. Bei
der Veröffentlichung erzielte es starke Ergebnisse bei Reasoning- und Tool-Use-Benchmarks wie Humanity’s Last
Exam und ARC-AGI – unterstützt durch den Echtzeit-Zugriff auf X und das Web.

Dieser Live-Suchzugriff ist die echte Differenzierung. Die meisten Spitzenmodelle antworten ausschließlich aus ihren Trainingsdaten sowie dem, was Sie in die Eingabeaufforderung (Prompt) einfügen; Grok hingegen kann direkt auf aktuelle Informationen zugreifen.
Bei Workloads, bei denen Aktualität entscheidend ist – etwa bei Monitoring, Recherchen zu aktuellen Themen oder bei allen Anwendungsfällen, bei denen eine veraltete Antwort einer falschen Antwort gleichkommt – rechtfertigt diese Funktion einen Aufpreis, den Benchmark-Werte nicht abbilden können.
Der Zugriff erfolgt ausschließlich über proprietäre Kanäle. Es gibt keine offenen Gewichte, und das Modell läuft ausschließlich über die xAI-API, die Grok-Apps sowie das SuperGrok-Abonnement. xAI hat inzwischen schnellere und kostengünstigere Varianten von Grok 4 veröffentlicht; wir listen hier jedoch nur die pro-Token-Preise für Modelle auf, deren Angaben wir verifiziert haben – daher behandelt diese Seite ausschließlich Grok 4 selbst.
alles, bei dem eine veraltete Antwort eine falsche Antwort ist – das ist auf eine Weise wertvoll, für die man bereit ist zu zahlen, die
Benchmark-Werte nicht abbilden.

Wo das 256K-Kontextfenster ins Gewicht fällt
Das Kontextfenster stellt die deutlichste Einschränkung gegenüber direkten Konkurrenten dar. Grok 4 bietet 256.000 Token, während Claude, Gemini und die DeepSeek-V4-Reihe jeweils etwa 1 Mio. Token erreichen. Für die meisten Anwendungen ist 256K mehr als ausreichend – das entspricht einem umfangreichen Buch. Bei der Analyse ganzer Code-Repositories, bei langen Dokumentenarchiven oder bei Workloads, die bewusst auf eine Retrieval-Schicht verzichten, stellt dies jedoch eine echte Einschränkung dar – und zwar zu einem Preisniveau, bei dem Konkurrenten keine vergleichbare Begrenzung auferlegen.
Dem steht entgegen, dass Grok keine Aufschläge für lange Kontexte verlangt. GPT-5.6 Sol berechnet Input- und Output-Tokens ab 272.000 Token mit dem Faktor 2 bzw. 1,5; Gemini 3.1 Pro verdoppelt den Input-Preis ab etwa 200.000 Token. Groks Tarif bleibt über das gesamte Kontextfenster hinweg konstant – was Sie sehen, ist auch das, was Sie bezahlen.
Lohnt sich Grok zu einem gemittelten Preis von 5,40 US-Dollar?

Das hängt nahezu ausschließlich davon ab, ob Sie den Live-Suchzugriff benötigen. Bewertet man allein die Leistung pro Dollar, fällt der Vergleich ungünstig aus: Die obige übergreifende Tabelle zeigt mehrere Modelle zu einem Bruchteil der Kosten; zudem liegen Open-Weight-Flaggschiffe mittlerweile nur noch wenige Punkte hinter den besten Closed-Source-Modellen – bei deutlich niedrigeren Preisen. Ein Team, das allein nach Kosten entscheidet, würde sich nicht für Grok entscheiden.

Bewertet man hingegen das, was Grok einzigartig leistet, ändert sich die Rechnung. Der Echtzeit-Zugriff auf X und das breitere Web ist keine Funktion, die sich durch den Einsatz eines günstigeren Anbieters mit mehr Tokens nachbilden lässt – stattdessen müssten Sie eine eigene Retrieval-Pipeline entwickeln und betreiben, was wiederum eigene Kosten und eigene Fehlerquellen mit sich bringt. Ist diese Funktionalität zentral für Ihr Produkt, ist Groks Preisgestaltung im entsprechenden Segment durchaus angemessen.
Ist sie nicht zentral, sollten Sie Grok als Spezialisten betrachten, an den Sie gezielt bestimmte Anfragen weiterleiten – statt es als Standardmodell einzusetzen. Schätzen Sie ab, welche Kosten diese Aufteilung verursachen würde, und vergleichen Sie
die Leistungsfähigkeit jedes Modells im
Wie viel kostet die Grok-API?
Grok kostet 3,00 US-Dollar pro 1 Mio. Input-Tokens und 15,00 US-Dollar pro 1 Mio. Output-Tokens bei Grok 4 – bei einer typischen Input-zu-Output-Mischung von 4:1 ergibt sich ein gemittelter Preis von 5,40 US-Dollar pro 1 Mio. Input- und Output-Tokens werden separat abgerechnet; Output-Tokens sind dabei die teurere Komponente.

Wie hoch sind die monatlichen Kosten für Grok?
Bei 20 Mio. Input- und 5 Mio. Output-Tokens pro Monat belaufen sich die Kosten für Grok 4 auf rund 135 US-Dollar. Ein Nebenprojekt mit 1 Mio. Input- und 0,25 Mio. Output-Tokens kostet nur einen Bruchteil davon. Nutzen Sie den AI-API-Kostenrechner für Ihre eigenen Volumina.
Ist Grok günstiger als Mistral AI?

Bei den Einstiegspreisen beginnt Grok bei 5,40 US-Dollar pro 1 Mio. gemittelter Tokens, während Mistral AI bei Mistral 7B mit 0,0220 US-Dollar startet. Mistral AI ist somit der günstigere Einstiegspunkt – allerdings unterscheiden sich die Leistungen deutlich; vergleichen Sie beide daher vor einem Wechsel auf der Leaderboard-Tabelle.

Warum berechnet Grok für Output-Tokens höhere Preise als für Input-Tokens?
Dollar fällt der Vergleich ungünstig aus: Die obige Tabelle mit Modellen verschiedener Anbieter zeigt mehrere Modelle zu einem
Bruchteil der Kosten; zudem erzielen mittlerweile Open-Weight-Flaggschiffe nahezu dieselben Punktzahlen wie die besten Closed-Source-Modelle, obwohl sie deutlich günstiger sind. Ein Team, das allein nach Preis entscheidet, würde sich nicht für Grok entscheiden.
Modelle, während sie deutlich weniger Energie verbrauchen. Ein Team, das allein nach dem Preis entscheidet, würde sich nicht für Grok entscheiden.

Bewertet man hingegen das, was Grok einzigartig leistet, ändert sich die Rechnung. Der Echtzeit-Zugriff auf X und das
gesamte Web ist keine Funktion, die man durch die Bezahlung weiterer Tokens bei einem günstigeren Anbieter nachbilden könnte – stattdessen
müsste man eine eigene Retrieval-Pipeline entwickeln und betreiben, was wiederum eigene Kosten und eigene
Ausfallmodi mit sich bringt. Ist diese Fähigkeit zentral für Ihr Produkt, dann ist Groks Preisgestaltung im jeweiligen Segment angemessen.
Ist sie es nicht, sollten Sie Grok als Spezialisten betrachten, an den Sie gezielte Anfragen routen, statt es als Standardlösung einzusetzen. Schätzen Sie ab, was diese Aufteilung kosten würde,

Falls es nicht zentral ist, betrachten Sie Grok als Spezialisten, an den Sie gezielte Anfragen weiterleiten – und nicht als
Standardlösung. Schätzen Sie ab, was diese Aufteilung kosten würde,
KI-API-Kostenrechner, und vergleichen
die Leistungsfähigkeit im Verhältnis zum Preis für jedes Modell in der
LLM-Leaderboard bevor Sie sich verpflichten.

Häufig gestellte Fragen

Wie viel kostet die Grok-API?

Grok kostet 3,00 USD pro 1 Mio. Eingabetokens und 15,00 USD pro 1 Mio. Ausgabetokens bei Grok 4, was bei einer typischen Eingabe-zu-Ausgabe-Mischung von 4:1 einem Durchschnittspreis von 5,40 USD pro 1 Mio. Tokens entspricht. Eingabe- und Ausgabetokens werden separat abgerechnet, wobei Ausgabetokens teurer sind.

Wie viel kostet Grok pro Monat?

Bei 20 Mio. Eingabe- und 5 Mio. Ausgabetokens pro Monat belaufen sich die Kosten für Grok 4 auf etwa 135 USD. Ein Nebenprojekt mit 1 Mio. Eingabe- und 0,25 Mio. Ausgabetokens kostet nur einen Bruchteil davon. Nutzen Sie den AI-API-Kostenrechner für Ihre eigenen Volumina.

Ist Grok günstiger als Mistral AI?

Bei den Einstiegspreisen beginnt Grok bei 5,40 USD pro 1 Mio. gemischter Tokens, während Mistral AI bei Mistral 7B mit 0,0220 USD pro 1 Mio. Tokens startet. Mistral AI ist somit der günstigere Einstiegspunkt, doch unterscheiden sich die Leistungsmerkmale – vergleichen Sie beide Modelle daher vor einem Wechsel anhand der Rangliste.

Warum berechnet Grok für Ausgabetokens höhere Gebühren als für Eingabetokens?

Ausgabetokens werden einzeln generiert und können nicht wie Prompts gebündelt werden, weshalb ihre Bereitstellung teurer ist. Daher sind promptlastige Workloads wie Retrieval und Klassifikation deutlich kostengünstiger als generierungsintensive Aufgaben – und daher ist der gemischte Satz aussagekräftiger als der reine Eingabepreis.

Die Preise entsprechen den offiziell veröffentlichten Listenpreisen für die jeweiligen Haupt-APIs der Modelle und werden regelmäßig aktualisiert, sobald Anbieter Änderungen vornehmen. Rabatte für hohe Volumina, Batch-Verarbeitung oder zwischengespeicherte Eingaben sind nicht enthalten. Zuletzt überprüft im August 2026.

Scroll to Top
Featured on There's An AI For That