La tarification de l’API Claude varie de 1 $ par million de jetons d’entrée pour Claude Haiku 4.5 à 10 $
pour Claude Fable 5. Anthropic facture les jetons d’entrée et de sortie séparément, et le coût des jetons de sortie est cinq fois supérieur
à celui des jetons d’entrée sur toute la gamme — ainsi, le prix affiché pour les jetons d’entrée révèle très peu
du montant réel que vous devrez payer. Le tableau ci-dessous recense tous les modèles actuels, et la colonne « combiné »
correspond à la valeur pertinente pour les comparaisons.
Tarification de l’API Claude : coût par million de jetons pour chaque modèle
| Modèle | Entrée : $/1 million | Sortie : $/1 million | Coût combiné par million de dollars | Contexte |
|---|---|---|---|---|
| Claude Haiku 4.5 | $1.00 | $5.00 | $1.80 | 200 000 |
| Claude Sonnet 5 | $2.00 | $10.00 | $3.60 | 1 million |
| Claude Sonnet 4.6 | $3.00 | $15.00 | $5.40 | 1 million |
| Claude Opus 5 | $5.00 | $25.00 | $9.00 | 1 million |
| Claude Opus 4.8 | $5.00 | $25.00 | $9.00 | 1 million |
| Claude Fable 5 | $10.00 | $50.00 | $18.00 | 1 million |
Le tarif combiné correspond au taux effectif pour un ratio entrée/sortie de 4:1, qui reflète ce qu’une charge de travail typique de discussion ou de recherche produit réellement. C’est ce chiffre qu’il faut comparer entre fournisseurs — un prix affiché pour les entrées masque le coût réel des sorties.
Coût mensuel de Claude
| Charge de travail | Jetons/mois | Claude Haiku 4.5 le moins cher | Claude Fable 5 niveau le plus performant |
|---|---|---|---|
| Projet secondaire | 1 million en entrée / 0,25 million en sortie | $2.25 | $23 |
| Petite équipe | 20 millions en entrée / 5 millions en sortie | $45 | $450 |
| Production | 200 millions en entrée / 50 millions en sortie | $450 | $4,500 |
Modélisez vos propres volumes sur la Calculateur de coûts des API IA.
Comment Claude se compare aux autres fournisseurs
Le modèle le moins cher proposé par chaque fournisseur, afin d’assurer une comparaison équitable sur le coût d’entrée.
| Fournisseur | Modèle le moins cher | Coût combiné par million de dollars |
|---|---|---|
| Mistral AI | Mistral 7B | $0.0220 |
| Meta | Llama 3.1 8B | $0.0220 |
| Alibaba | Qwen3 8B | $0.0600 |
| Gemma 3 4B | $0.0600 | |
| Microsoft | Phi-4 | $0.0840 |
| DeepSeek | DeepSeek V4-Flash | $0.168 |
| Moonshot AI | Kimi K2.7 Code | $0.980 |
| Anthropic cette page | Claude Haiku 4.5 | $1.80 |
| Zhipu AI | GLM 5.2 | $2.00 |
| xAI | Grok 4 | $5.40 |
| OpenAI | GPT-5.6 Sol | $10.00 |
Le modèle le moins cher ne signifie pas nécessairement le meilleur rapport qualité-prix — vérifiez les performances en complément du prix sur la Classement des grands modèles linguistiques (LLM), ou parcourez tous les modèles disponibles dans la Base de données des modèles d'IA.
Quel modèle Claude devez-vous utiliser ?
La gamme d’Anthropic suit une progression linéaire et claire des capacités, et la plupart des équipes paient trop cher en démarrant
au sommet de cette échelle.
Haiku 4.5 doit être considéré comme le modèle par défaut, et non comme une solution de repli. À un tarif de
1 $ en entrée / 5 $ en sortie, il absorbe un volume de trafic dix fois supérieur à celui d’un modèle de niveau Opus pour le
même budget, et la grande majorité des tâches exécutées par une application en production — classification,
extraction, routage, génération courte — n’a jamais nécessité un modèle de pointe. Sa fenêtre contextuelle de 200 K est sa seule vraie limite ; les autres modèles de la gamme atteignent 1 M.
est la seule limite réelle ; le reste de la ligne atteint 1 million.
Sonnet 5 est le modèle polyvalent. Son profil sur les benchmarks met fortement l’accent sur la programmation : 85,2 % sur
SWE-Bench Verified, 80,4 % sur Terminal-Bench 2.1 et 81,2 % sur OSWorld-Verified. Ces scores sont proches de ceux de modèles coûtant plusieurs fois plus cher, ce qui constitue précisément l’argument principal en faveur de l’adoption de Sonnet
proche de modèles coûtant plusieurs fois plus cher, ce qui constitue précisément l’argument principal en faveur de l’adoption de Sonnet
plutôt que d’Opus comme cœur d’un agent dédié au développement logiciel.
Opus 5 est le modèle phare, classé premier sur l’« Artificial Analysis Intelligence Index » avec un score de 61. Il est proposé au même prix qu’Opus 4.8, si bien que toute personne déjà abonnée à Opus 4.8 peut migrer simplement en modifiant la chaîne de caractères désignant le modèle, sans impact budgétaire — une mise à jour vivement recommandée, car un bond générationnel de capacité à prix constant reste exceptionnel.
Index à 61. Il est arrivé au prix inchangé d’Opus, donc toute personne déjà abonnée à Opus 4.8 peut migrer
simplement en modifiant la chaîne de caractères désignant le modèle, sans incidence budgétaire — une opération à réaliser sans tarder, car un saut générationnel de capacités à prix constant est rare.
générer une réponse erronée est coûteux : agents autonomes multi-étapes, recherches approfondies, refactoring sur de larges bases de code.
Fable 5 n’a de sens qu’au sommet de la courbe de difficulté. À 50 $ par million
de jetons de sortie, il coûte environ cinq fois plus qu’Opus côté sortie, ce qui signifie que diriger vers lui des requêtes ordinaires brûle inutilement le budget sans gain mesurable. Réservez-le aux tâches où une réponse erronée aurait un coût élevé : agents multi-étapes non supervisés, recherches approfondies, refactos sur de larges bases de code.
ne rapporte aucun gain mesurable. Réservez-le aux tâches où une réponse erronée est
coûteuse : agents multi-étapes sans surveillance, recherches approfondies, refacturations à grande échelle d’une base de code.
Le schéma efficace repose sur un routeur — Haiku en première ligne, avec escalade vers Sonnet ou Opus uniquement lorsque la vérification de confiance échoue. Les équipes qui instrumentent leur répartition de jetons constatent généralement que la facture provient essentiellement des jetons de sortie, et qu’une limitation stricte de ces derniers
et le déplacement des premiers brouillons
vers un niveau moins coûteux permet d’économiser davantage que n’importe quelle astuce de compression de prompt. max_tokens et déplacer les premiers brouillons
vers un niveau moins coûteux permet d’économiser davantage que n’importe quelle astuce de compression de prompt.
Trois aspects des tarifs Claude qui piègent souvent les utilisateurs
Le prix de Sonnet 5 est temporaire. Le tarif introductif de 2 $ / 10 $ s’applique
jusqu’au 31 août 2026, date à laquelle le tarif standard de 3 $ / 15 $ entrera en vigueur. Cette augmentation de 50 % sera appliquée discrètement à tout workload dimensionné sur la base des tarifs actuels. Si vous
modélisez l’économie unitaire d’un produit devant être lancé cette année, faites-le sur la base de 3 $ / 15 $ et considérez le tarif actuel comme une remise.
modélisent la rentabilité unitaire d’un produit lancé cette année, modélisez-le à 3 $ / 15 $ et considérez
le tarif actuel comme une remise.
Le mode « Fast » d’Opus 5 double les deux tarifs. Le niveau « Fast », disponible uniquement via l’API, est facturé
10 $ / 50 $ au lieu de 5 $ / 25 $. Ce surcoût n’est justifié que lorsque la latence constitue un critère essentiel du produit — assistants interactifs de programmation, boucles d’agents en temps réel où l’utilisateur attend une réponse. Pour les traitements par lots, les agents nocturnes
et toute tâche exécutée en file d’attente, le mode standard fournit la même intelligence pour la moitié du prix.
et tout ce qui est en file d’attente, le mode standard fournit la même intelligence pour la moitié du prix.
Aucune majoration n’est appliquée pour les longs contextes. C’est là un avantage discret face aux concurrents.
Claude Opus 4.8 facture sa fenêtre contextuelle de 1 million de jetons au même tarif, du premier au millionième jeton. Plusieurs modèles concurrents augmentent progressivement le tarif d’entrée dès lors qu’un prompt dépasse un seuil donné —
GPT-5.6 Sol applique un coefficient multiplicateur de 2 sur l’entrée et de 1,5 sur la sortie au-delà de 272 K jetons, tandis que Gemini 3.1 Pro augmente approximativement de moitié le tarif d’entrée au-delà de 200 K jetons. Cela rend leurs fonctionnalités de long contexte imprévisibles sur le plan budgétaire,
car le même service coûte différemment selon la quantité de texte collée par l’utilisateur. Avec
Claude, vous pouvez dimensionner vos prompts en fonction de ce qui produit la meilleure réponse, plutôt que de vous calquer sur un « mur tarifaire ».
parce que le même fonctionnement coûte un montant différent selon la quantité de texte collée par l’utilisateur. Avec
Claude, vous pouvez ajuster la taille des invites en fonction de ce qui produit la meilleure réponse, plutôt que de les calibrer en fonction d’un seuil tarifaire
rigide.
Questions fréquemment posées
Combien coûte l’API Claude ?
Les tarifs de l’API Claude vont de 1,80 $ par million de jetons combinés (blended) pour Claude Haiku 4.5 à 18,00 $ pour Claude Fable 5. Le tarif « blended » suppose un ratio entrée/sortie de 4:1. Les jetons d’entrée et de sortie sont facturés séparément, et les jetons de sortie sont toujours plus coûteux.
Quel est le modèle Claude le moins cher ?
Claude Haiku 4.5, à 1,00 $ par million de jetons d’entrée et 5,00 $ par million de jetons de sortie. Une charge de travail mensuelle pour une petite équipe (20 millions de jetons d’entrée et 5 millions de jetons de sortie) coûte environ 45 $ sur ce modèle.
Quel est le coût mensuel de Claude ?
Pour une charge de travail mensuelle de 20 millions de jetons d’entrée et 5 millions de jetons de sortie, Claude Haiku 4.5 coûte environ 45 $, tandis que Claude Fable 5 coûte environ 450 $. Un projet secondaire de 1 million de jetons d’entrée et 0,25 million de jetons de sortie revient à une fraction seulement de ce montant. Utilisez la calculatrice de coûts de l’API IA pour estimer vos propres volumes.
Claude est-il moins cher que Mistral AI ?
Au niveau des tarifs d’entrée, Claude débute à 1,80 $ par million de jetons combinés (entrée + sortie), tandis que Mistral AI débute à 0,0220 $ pour le modèle Mistral 7B. Mistral AI constitue donc le point d’entrée le moins coûteux, bien que les capacités diffèrent — comparez les deux modèles sur le classement avant de changer.
Pourquoi Claude facture-t-il davantage les jetons de sortie que les jetons d’entrée ?
Les jetons de sortie sont générés un par un et ne peuvent pas être traités par lots comme un prompt, ce qui augmente leur coût de traitement. C’est pourquoi les charges de travail axées sur les prompts — telles que la recherche ou la classification — sont nettement moins coûteuses à exécuter que celles axées sur la génération, et pourquoi le tarif combiné revêt plus d’importance que le prix affiché pour les entrées.
Les prix indiqués correspondent aux tarifs publics officiels pour l’API principale de chaque modèle, mis à jour régulièrement à mesure que les fournisseurs les modifient. Les remises liées aux volumes, au traitement par lots ou au cache des entrées ne sont pas incluses. Dernière mise à jour en août 2026.

