I prezzi dell'API Claude vanno da 1 dollaro per 1 milione di token in ingresso su Claude Haiku 4.5 fino a 10 dollari
su Claude Fable 5. Anthropic fattura separatamente i token in ingresso e in uscita, e il costo dei token in uscita è cinque volte superiore
a quello dei token in ingresso sull'intera gamma di modelli: pertanto, il prezzo indicato per i token in ingresso rivela molto poco
del costo effettivo che si dovrà sostenere. La tabella seguente elenca tutti i modelli attualmente disponibili; la colonna "combinato"
indica il valore effettivamente confrontabile.
Prezzi dell'API Claude: ogni modello, costo per 1 milione di token
| Modello | Input $/1 milione | Output $/1 milione | Costo combinato ($/1 milione) | Contesto |
|---|---|---|---|---|
| Claude Haiku 4.5 | $1.00 | $5.00 | $1.80 | 200.000 |
| Claude Sonnet 5 | $2.00 | $10.00 | $3.60 | 1 milione |
| Claude Sonnet 4.6 | $3.00 | $15.00 | $5.40 | 1 milione |
| Claude Opus 5 | $5.00 | $25.00 | $9.00 | 1 milione |
| Claude Opus 4.8 | $5.00 | $25.00 | $9.00 | 1 milione |
| Claude Fable 5 | $10.00 | $50.00 | $18.00 | 1 milione |
Il costo combinato rappresenta il tasso effettivo per un rapporto ingresso-uscita di 4:1, che corrisponde alla tipica produzione di un carico di lavoro basato su chat o recupero informazioni. È questo il valore da confrontare tra i diversi fornitori: un prezzo indicativo per l’input nasconde infatti quanto costa l’output.
Quanto costa Claude al mese
| Carico di lavoro | Token/mese | Claude Haiku 4.5 più economico | Claude Fable 5 livello più performante |
|---|---|---|---|
| Progetto secondario | 1 milione in ingresso / 0,25 milioni in uscita | $2.25 | $23 |
| Piccolo team | 20 milioni in ingresso / 5 milioni in uscita | $45 | $450 |
| Produzione | 200 milioni in ingresso / 50 milioni in uscita | $450 | $4,500 |
Modella i tuoi volumi personalizzati nella Calcolatore dei costi delle API per l'IA.
Come Claude si confronta con altri provider
Il modello più economico offerto da ciascun fornitore, in modo che il confronto sia omogeneo dal punto di vista del costo d’ingresso.
| Fornitore | Modello più economico | Costo combinato ($/1 milione) |
|---|---|---|
| Mistral AI | Mistral 7B | $0.0220 |
| Meta | Llama 3.1 8B | $0.0220 |
| Alibaba | Qwen3 8B | $0.0600 |
| Gemma 3 4B | $0.0600 | |
| Microsoft | Phi-4 | $0.0840 |
| DeepSeek | DeepSeek V4-Flash | $0.168 |
| Moonshot AI | Kimi K2.7 Code | $0.980 |
| Anthropic questa pagina | Claude Haiku 4.5 | $1.80 |
| Zhipu AI | GLM 5.2 | $2.00 |
| xAI | Grok 4 | $5.40 |
| OpenAI | GPT-5.6 Sol | $10.00 |
Il modello più economico non equivale necessariamente al miglior rapporto qualità-prezzo: verifica le capacità del modello insieme al prezzo sulla Classifica LLM, oppure esplora tutti i modelli disponibili nel Database di modelli di intelligenza artificiale.
Quale modello Claude dovresti utilizzare?
La linea di Anthropic è una scala di capacità semplice e lineare, e la maggior parte dei team paga eccessivamente iniziando
dal vertice.
Haiku 4.5 è il modello da considerare come predefinito, non come riserva. Con un costo di $1 in ingresso / $5 in uscita, gestisce un ordine di grandezza maggiore di traffico rispetto a un modello di livello Opus per lo stesso importo, e la stragrande maggioranza delle attività svolte da un’applicazione in produzione — classificazione, estrazione, instradamento, generazione breve — non richiede mai un modello all’avanguardia. Il suo contesto di 200K rappresenta l’unico vero limite; tutti gli altri modelli della linea raggiungono invece 1M.
1 dollaro in entrata / 5 dollari in uscita: gestisce un ordine di grandezza di traffico in più rispetto a un modello di fascia Opus per lo stesso costo, e la stragrande maggioranza delle operazioni svolte da un’applicazione in produzione — classificazione, estrazione, instradamento, generazione di testi brevi — non richiede mai un modello all’avanguardia. Il suo contesto di 200K rappresenta l’unico vero limite; il resto della linea raggiunge invece 1M.
stesso denaro, e la vasta maggioranza di ciò che un’applicazione in produzione fa — classificazione,
estrazione, instradamento, generazione di testi brevi — non ha mai richiesto un modello all’avanguardia. Il suo contesto di 200K è l’unico vero limite; il resto della linea raggiunge 1M.
è l’unico vero limite; il resto della linea raggiunge 1M.
Sonnet 5 è il modello di riferimento. Il suo profilo sui benchmark è fortemente orientato alla programmazione: 85,2% su SWE-Bench Verified, 80,4% su Terminal-Bench 2.1 e 81,2% su OSWorld-Verified. Questi valori sono vicini a quelli di modelli che costano diverse volte di più, ed è proprio questo il motivo principale per cui conviene posizionare Sonnet, anziché Opus, al centro di un agente specializzato nella scrittura di codice.
Verificato su SWE-Bench, 80,4% su Terminal-Bench 2.1 e 81,2% su OSWorld-Verified. Questi risultati si collocano vicino a quelli di modelli che costano diverse volte di più, il che costituisce proprio l’argomento principale a favore dell’impiego di Sonnet, anziché di Opus, come modello centrale in un agente per la programmazione.
anziché di Opus, come modello centrale in un agente per la programmazione.
piuttosto che Opus al centro di un agente di codifica.
Opus 5 è il modello di punta, classificato primo sull’Artificial Analysis Intelligence Index con un punteggio di 61. È stato lanciato mantenendo invariati i prezzi di Opus, quindi chiunque già utilizzi Opus 4.8 può migrare semplicemente modificando la stringa del modello, senza alcuna conseguenza sul budget — operazione consigliabile da effettuare tempestivamente, poiché un salto generazionale nelle capacità a parità di prezzo è un evento raro.
Indice pari a 61. È stato introdotto mantenendo invariati i prezzi di Opus, quindi chiunque già utilizzi Opus 4.8 può eseguire la migrazione semplicemente modificando la stringa del modello, senza alcun impatto sul budget — una scelta consigliabile da attuare tempestivamente, poiché un salto generazionale nelle capacità a parità di prezzo è un evento raro.
con una stringa del modello e senza alcuna conseguenza sul budget — vale la pena farlo tempestivamente, perché un salto generazionale nelle capacità a parità di prezzo è un evento raro.
perché un salto generazionale nelle capacità a parità di prezzo è un evento raro.
Fable 5 ha senso soltanto ai vertici della curva di difficoltà. A $50 per 1 milione di token in output costa circa cinque volte di più di Opus sul lato dell’output, quindi instradare richieste ordinarie verso questo modello comporta un inutile spreco di budget senza alcun guadagno misurabile. Riservalo a compiti in cui una risposta errata ha un costo elevato: agenti multi-step non supervisionati, ricerche approfondite, refactoring su ampie codebase.
token in uscita costa circa cinque volte di più rispetto a Opus sul lato dell’output, quindi instradare richieste ordinarie verso questo modello comporta uno spreco di budget senza alcun guadagno misurabile. Riservatelo invece ai compiti in cui una risposta errata è
una risposta errata è
costoso: agenti multi-step non supervisionati, ricerche approfondite, refactoring su un ampio codebase.
Il pattern efficace prevede un router — Haiku in prima linea, con escalation a Sonnet o Opus solo quando un controllo di affidabilità fallisce. I team che monitorano la composizione dei propri token scoprono spesso che l’output è effettivamente la voce principale della fattura, e che limitare la lunghezza dell’output e spostare le prime bozze
su un livello tariffario più economico permette di risparmiare molto di più rispetto a qualsiasi tecnica di compressione dei prompt.
e spostare le prime bozze max_tokens su un livello tariffario più economico
permette di risparmiare molto di più rispetto a qualsiasi tecnica di compressione dei prompt.
Tre aspetti della tariffazione Claude che sorprendono spesso gli utenti
Il prezzo di Sonnet 5 è temporaneo. Il tasso di $2 / $10 è introduttivo e rimarrà valido fino al 31 agosto 2026; successivamente entrerà in vigore la tariffa standard di $3 / $15. Si tratta di un aumento del 50%, che verrà applicato automaticamente a qualsiasi carico di lavoro calibrato sui valori attuali. Se stai modellando l’economia unitaria di un prodotto che verrà lanciato quest’anno, fai riferimento al prezzo di $3 / $15 e considera l’attuale tariffa come uno sconto.
Il tasso di $3 / $15 è un aumento del 50%, che verrà applicato automaticamente a qualsiasi carico di lavoro calibrato sui valori attuali. Se stai modellando l’economia unitaria di un prodotto che verrà lanciato quest’anno, fai riferimento al prezzo di $3 / $15 e considera l’attuale tariffa come uno sconto.
Se stai modellando l’economia unitaria di un prodotto che verrà lanciato quest’anno, fai riferimento al prezzo di $3 / $15 e considera l’attuale tariffa come uno sconto.
Se stai modellando l’economia unitaria di un prodotto che verrà lanciato quest’anno, fai riferimento al prezzo di $3 / $15 e considera l’attuale tariffa come uno sconto.
oggi’s rate as a discount.
La modalità Fast di Opus 5 raddoppia entrambi i tassi. Il livello API-only Fast addebita $10 / $50 invece di $5 / $25. Questa tariffa è giustificata soltanto quando la latenza è un fattore critico per il prodotto — assistenti interattivi per la programmazione, cicli di agenti in tempo reale in cui l’utente attende una risposta. Per lavori batch, agenti notturni e qualsiasi attività gestita in coda, la modalità standard offre la stessa intelligenza al 50% del costo.
$10 / $50 piuttosto che $5 / $25. Si giustifica soltanto laddove la latenza è un fattore critico per il prodotto — assistenti interattivi per la programmazione, cicli di agenti in tempo reale in cui l’utente attende una risposta.
Per lavori batch, agenti notturni e qualsiasi attività gestita in coda, la modalità standard offre la stessa intelligenza al 50% del costo.
Per lavori batch, agenti notturni e qualsiasi attività gestita in coda, la modalità standard offre la stessa intelligenza al 50% del costo.
Non esiste un sovrapprezzo per contesti lunghi. Questo è il vantaggio silenzioso rispetto ai concorrenti.
Claude Opus 4.8 addebita il suo contesto da 1 milione di token allo stesso tasso, dal primo all’ultimo token. Diversi modelli concorrenti invece aumentano progressivamente il costo dell’input una volta superata una certa soglia — GPT-5.6 Sol addebita il doppio per l’input e 1,5 volte per l’output oltre i 272K token, mentre Gemini 3.1 Pro raddoppia approssimativamente il costo dell’input oltre i 200K token.
GPT-5.6 Sol addebita il doppio per l’input e 1,5 volte per l’output oltre i 272K token, mentre Gemini 3.1 Pro raddoppia approssimativamente il costo dell’input oltre i 200K token.
GPT-5.6 Sol addebita il doppio per l’input e 1,5 volte per l’output oltre i 272K token, mentre Gemini 3.1 Pro raddoppia approssimativamente il costo dell’input oltre i 200K token.
Ciò rende imprevedibile la pianificazione del budget per le funzionalità relative a contesti lunghi, poiché lo stesso strumento ha un costo diverso a seconda della quantità di testo incollato dall’utente.
Con Claude puoi dimensionare i prompt in base a ciò che produce la risposta migliore, anziché in base a un “salto tariffario” improvviso.
Con Claude puoi dimensionare i prompt in base a ciò che produce la risposta migliore, anziché in base a un “salto tariffario” improvviso.
Con Claude puoi dimensionare i prompt in base a ciò che produce la risposta migliore, anziché in base a un “salto tariffario” improvviso.
Domande frequenti
Quanto costa l’API Claude?
La tariffazione dell’API Claude va da $1,80 per 1 milione di token combinati su Claude Haiku 4.5 fino a $18,00 su Claude Fable 5. Il valore “combinato” presuppone un rapporto input/output pari a 4:1. Input e output vengono fatturati separatamente, e l’output è sempre la componente più costosa.
Qual è il modello Claude più economico?
Claude Haiku 4.5, a $1,00 per 1 milione di token in ingresso e $5,00 per 1 milione di token in uscita. Un carico di lavoro mensile per un piccolo team di 20 milioni di token in ingresso e 5 milioni di token in uscita costa circa $45.
Quanto costa Claude al mese?
Con 20 milioni di token in ingresso e 5 milioni di token in uscita al mese, Claude Haiku 4.5 costa circa $45, mentre Claude Fable 5 costa circa $450. Un progetto secondario con 1 milione di token in ingresso e 0,25 milioni di token in uscita costa solo una frazione di tale importo. Utilizza la calcolatrice dei costi dell’API per l’IA per valutare i tuoi volumi specifici.
Claude è più economico di Mistral AI?
Per i prezzi di livello base, Claude parte da $1,80 per 1 milione di token combinati (blended), mentre Mistral AI parte da $0,0220 per il modello Mistral 7B. Mistral AI rappresenta quindi il punto di ingresso più economico, anche se le capacità differiscono: confronta entrambi i modelli sulla classifica ufficiale prima di effettuare un passaggio.
Perché Claude addebita di più per i token in uscita rispetto a quelli in ingresso?
I token in output vengono generati uno alla volta e non possono essere elaborati in batch come invece avviene per i prompt, pertanto il loro servizio ha un costo maggiore. Questo spiega perché i carichi di lavoro incentrati sui prompt — ad esempio il recupero di informazioni o la classificazione — sono molto meno costosi rispetto a quelli orientati alla generazione, e perché il costo combinato è più significativo del semplice prezzo indicativo per l’input.
I prezzi indicati corrispondono alle tariffe pubblicate ufficialmente per l’API principale di ciascun modello e vengono aggiornati periodicamente in base alle modifiche apportate dai fornitori. Sconti per volume, elaborazione in batch o input memorizzati nella cache non sono inclusi. Ultimo aggiornamento: agosto 2026.

