I prezzi dell'API Grok ammontano a 3 $ per 1 milione di token in input e a 15 $ per 1 milione di token in output per Grok 4,
il che corrisponde a un costo combinato di circa 5,40 $ con una distribuzione tipica di utilizzo. Ciò colloca xAI nello stesso segmento dei modelli all'avanguardia di OpenAI e Anthropic, piuttosto che nella fascia economica — una scelta strategica che determina quando Grok rappresenta la soluzione più adatta e quando invece non lo è.
decisione che influenza quando Grok è la scelta giusta e quando non lo è.
decisione che influenza quando Grok è la scelta giusta e quando non lo è.
Prezzi dell'API Grok: ogni modello, per 1 milione di token
| Modello | Input $/1 milione | Output $/1 milione | Costo combinato ($/1 milione) | Contesto |
|---|---|---|---|---|
| Grok 4 | $3.00 | $15.00 | $5.40 | 256.000 token |
Il costo combinato rappresenta il tasso effettivo per un rapporto ingresso-uscita di 4:1, che corrisponde alla tipica produzione di un carico di lavoro basato su chat o recupero informazioni. È questo il valore da confrontare tra i diversi fornitori: un prezzo indicativo per l’input nasconde infatti quanto costa l’output.
Quanto costa Grok al mese
| Carico di lavoro | Token/mese | Grok 4 |
|---|---|---|
| Progetto secondario | 1 milione in ingresso / 0,25 milioni in uscita | $6.75 |
| Piccolo team | 20 milioni in ingresso / 5 milioni in uscita | $135 |
| Produzione | 200 milioni in ingresso / 50 milioni in uscita | $1,350 |
Modella i tuoi volumi personalizzati nella Calcolatore dei costi delle API per l'IA.
Come Grok si confronta con gli altri fornitori
Il modello più economico offerto da ciascun fornitore, in modo che il confronto sia omogeneo dal punto di vista del costo d’ingresso.
| Fornitore | Modello più economico | Costo combinato ($/1 milione) |
|---|---|---|
| Mistral AI | Mistral 7B | $0.0220 |
| Meta | Llama 3.1 8B | $0.0220 |
| Alibaba | Qwen3 8B | $0.0600 |
| Gemma 3 4B | $0.0600 | |
| Microsoft | Phi-4 | $0.0840 |
| DeepSeek | DeepSeek V4-Flash | $0.168 |
| Moonshot AI | Kimi K2.7 Code | $0.980 |
| Anthropic | Claude Haiku 4.5 | $1.80 |
| Zhipu AI | GLM 5.2 | $2.00 |
| xAI questa pagina | Grok 4 | $5.40 |
| OpenAI | GPT-5.6 Sol | $10.00 |
Il modello più economico non equivale necessariamente al miglior rapporto qualità-prezzo: verifica le capacità del modello insieme al prezzo sulla Classifica LLM, oppure esplora tutti i modelli disponibili nel Database di modelli di intelligenza artificiale.
Cosa si ottiene in cambio del prezzo
Grok 4 è stato lanciato il 9 luglio 2025 come modello di ragionamento di punta di xAI e successore di
Grok 3. Combina nativamente il ragionamento "chain-of-thought" con la comprensione multimodale, accettando
input testuali e immagini e restituendo testo, ed è dotato di una finestra contestuale di 256.000 token. Al
momento del lancio ha ottenuto risultati eccellenti su benchmark di ragionamento e utilizzo di strumenti, tra cui Humanity's Last
Exam e ARC-AGI, grazie anche all’accesso in tempo reale a X e al web.
Questo accesso in tempo reale alla ricerca è il vero fattore differenziante. La maggior parte dei modelli di ultima generazione risponde sulla base
dei dati di addestramento più qualsiasi informazione fornita nel prompt; Grok, invece, può accedere direttamente a informazioni aggiornate.
Per carichi di lavoro in cui la tempestività è fondamentale — monitoraggio, ricerca su argomenti emergenti,
qualsiasi attività in cui una risposta obsoleta equivale a una risposta errata — tale capacità vale il costo, in un modo che i
punteggi dei benchmark non riescono a catturare.
L’accesso è interamente proprietario. Non esistono pesi aperti, e il modello è disponibile esclusivamente tramite
l’API xAI, le app Grok e l’abbonamento SuperGrok. xAI ha successivamente rilasciato varianti più veloci e meno costose
di Grok 4; elenchiamo i prezzi pubblicati per token soltanto per i modelli di cui abbiamo verificato l’effettiva disponibilità, quindi
questa pagina riguarda esclusivamente Grok 4.
Dove la finestra contestuale da 256K diventa un limite
La finestra contestuale rappresenta il limite più evidente rispetto ai principali concorrenti. Grok 4 offre 256.000
token, mentre Claude, Gemini e la linea DeepSeek V4 raggiungono tutte circa 1 milione. Per la maggior parte
delle applicazioni, 256K sono più che sufficienti — equivalgono a un libro molto lungo. Tuttavia, per ragionamenti su interi repository,
archivi di documenti estesi o carichi di lavoro che evitano deliberatamente uno strato di retrieval, si tratta di un vero vincolo,
soprattutto a un prezzo in cui i concorrenti non impongono alcun limite del genere.
Il controvalore è che Grok non applica un sovrapprezzo per contesti lunghi. GPT-5.6 Sol addebita il doppio per l’input e
1,5 volte tanto per l’output oltre i 272K token; Gemini 3.1 Pro raddoppia approssimativamente il costo dell’input oltre i 200K. Il tariffario di Grok
è invece costante sull’intera finestra contestuale, quindi ciò che vedi è esattamente ciò che paghi.
Vale davvero $5,40 al milione (costo medio)?
Dipende quasi esclusivamente dal fatto che tu abbia bisogno dell’accesso in tempo reale alla ricerca. Valutato esclusivamente in base alla capacità per
dollaro, il confronto non è favorevole: la tabella comparativa multifornitore qui sopra mostra diversi modelli a una
frazione del costo, e i modelli di punta con pesi aperti ottengono oggi punteggi vicini di pochi punti ai migliori modelli chiusi, pur avendo costi molto inferiori. Un team che scegliesse esclusivamente in base al prezzo non opterebbe per Grok.
Valutato invece per ciò che fa in modo unico, il calcolo cambia. L’accesso in tempo reale a X e al
web più ampio non è una funzionalità replicabile semplicemente pagando un fornitore più economico con più token — dovresti
piuttosto costruire e mantenere autonomamente una pipeline di retrieval, con i relativi costi e i relativi
possibili punti di fallimento. Se questa capacità è centrale per il tuo prodotto, il prezzo di Grok è ragionevole
per la fascia di mercato in cui si colloca.
Se invece non è centrale, considera Grok come uno specialista a cui indirizzare richieste specifiche, piuttosto che come modello predefinito. Stima quanto costerebbe tale suddivisione nel
, e confronta
la capacità rispetto al prezzo per ogni modello presente nella
Calcolatore dei costi delle API per l'IAtabella comparativa.
tabella comparativa.
Classifica LLM prima di impegnarsi.
Domande frequenti
Quanto costa l’API Grok?
Grok costa $3,00 per 1 milione di token in input e $15,00 per 1 milione di token in output su Grok 4, per un costo medio di $5,40 per 1 milione in un tipico rapporto input/output di 4:1. Input e output sono fatturati separatamente, e l’output è la componente più costosa.
Quanto costa Grok al mese?
Con 20 milioni di token in input e 5 milioni in output al mese, Grok 4 costa circa $135. Un progetto secondario con 1 milione di token in input e 0,25 milioni in output costa solo una frazione di tale importo. Usa la calcolatrice dei costi delle API per l’IA per valutare i tuoi volumi specifici.
Grok è più economico di Mistral AI?
Sui prezzi di ingresso, Grok parte da $5,40 per 1 milione (costo medio), mentre Mistral AI parte da $0,0220 su Mistral 7B. Mistral AI rappresenta quindi un punto di ingresso più economico, sebbene le capacità differiscano — confronta entrambi sulla classifica prima di effettuare il passaggio.
Perché Grok addebita di più per i token in output rispetto a quelli in input?
I token in output vengono generati uno alla volta e non possono essere elaborati in batch come invece avviene per i prompt, pertanto il loro servizio ha un costo maggiore. Questo spiega perché i carichi di lavoro incentrati sui prompt — ad esempio il recupero di informazioni o la classificazione — sono molto meno costosi rispetto a quelli orientati alla generazione, e perché il costo combinato è più significativo del semplice prezzo indicativo per l’input.
I prezzi indicati corrispondono alle tariffe pubblicate ufficialmente per l’API principale di ciascun modello e vengono aggiornati periodicamente in base alle modifiche apportate dai fornitori. Sconti per volume, elaborazione in batch o input memorizzati nella cache non sono inclusi. Ultimo aggiornamento: agosto 2026.

