Los precios de la API de Claude van desde 1 $ por cada millón de tokens de entrada en Claude Haiku 4.5 hasta 10 $
en Claude Fable 5. Anthropic factura por separado los tokens de entrada y los de salida, y el costo de los tokens de salida es cinco veces superior al de los de entrada en todo el rango; por tanto, el precio indicado únicamente para la entrada aporta muy poca información sobre
lo que realmente pagará. La tabla siguiente incluye todos los modelos actuales, y la columna «combinado»
es el valor que debe compararse.
Precios de la API de Claude: todos los modelos, por cada millón de tokens
«Combinado» representa la tarifa efectiva para una proporción entrada/salida de 4:1, que es la que genera típicamente una carga de trabajo de chat o recuperación. Es el valor que debe compararse entre proveedores, ya que un precio destacado solo para la entrada oculta el costo real de la salida.
| Modelos | Entrada: $/1 millón | Salida: $/1 millón | Dólares por millón combinados | Contexto |
|---|---|---|---|---|
| Claude Haiku 4.5 | $1.00 | $5.00 | $1.80 | 200 000 |
| Claude Sonnet 5 | $2.00 | $10.00 | $3.60 | 1 millón |
| Claude Sonnet 4.6 | $3.00 | $15.00 | $5.40 | 1 millón |
| Claude Opus 5 | $5.00 | $25.00 | $9.00 | 1 millón |
| Claude Opus 4.8 | $5.00 | $25.00 | $9.00 | 1 millón |
| Claude Fable 5 | $10.00 | $50.00 | $18.00 | 1 millón |
«Combinado» es la tarifa efectiva para una proporción entrada/salida de 4:1, que es la que realmente genera una carga de trabajo típica de chat o recuperación de información. Es el valor que debe compararse entre proveedores; un precio publicitario solo para la entrada oculta el coste real del lado de la salida.
más económico
| Carga de trabajo | Tokens/mes | Claude Haiku 4.5 más económico | Claude Fable 5 nivel más potente |
|---|---|---|---|
| Proyecto secundario | 1 millón de tokens de entrada / 0,25 millones de tokens de salida | $2.25 | $23 |
| Pequeño equipo | 20 millones de tokens de entrada / 5 millones de tokens de salida | $45 | $450 |
| Producción | 200 millones de tokens de entrada / 50 millones de tokens de salida | $450 | $4,500 |
Modele sus propios volúmenes en la Calculadora de costos de API de IA.
Cómo se compara Claude con otros proveedores
El modelo más económico de cada proveedor, de modo que la comparación sea homogénea desde el punto de vista del coste de entrada.
| Proveedor | Modelo más económico | Dólares por millón combinados |
|---|---|---|
| Mistral AI | Mistral 7B | $0.0220 |
| Meta | Llama 3.1 8B | $0.0220 |
| Alibaba | Qwen3 8B | $0.0600 |
| Gemma 3 4B | $0.0600 | |
| Microsoft | Phi-4 | $0.0840 |
| DeepSeek | DeepSeek V4-Flash | $0.168 |
| Moonshot AI | Kimi K2.7 Code | $0.980 |
| Anthropic esta página | Claude Haiku 4.5 | $1.80 |
| Zhipu AI | GLM 5.2 | $2.00 |
| xAI | Grok 4 | $5.40 |
| OpenAI | GPT-5.6 Sol | $10.00 |
Lo más económico no equivale necesariamente al mejor valor; compruebe también las capacidades junto con el precio en la Clasificación de modelos de lenguaje grande (LLM), o explore todos los modelos disponibles en la Base de datos de modelos de IA.
¿Qué modelo Claude debería usar?
La línea de Anthropic es una escalera de capacidades sencilla, y la mayoría de los equipos pagan de más al comenzar
en la parte superior de dicha escalera.
Haiku 4.5 debe considerarse el modelo predeterminado, no una alternativa de respaldo. Con una relación de coste de $1 por entrada / $5 por salida, absorbe una cantidad de tráfico diez veces mayor que un modelo de nivel Opus por el
mismo precio, y la inmensa mayoría de las tareas que realiza una aplicación en producción —clasificación,
extracción, enrutamiento, generación de texto breve— nunca requiere un modelo puntero. Su contexto de 200K
es su única limitación real; el resto de la línea alcanza los 1M.
Sonnet 5
es el modelo de trabajo habitual. Su perfil en pruebas de referencia está centrado en programación: 85,2 % en SWE-Bench Verified, 80,4 % en Terminal-Bench 2.1 y 81,2 % en OSWorld-Verified. Estos resultados se sitúan
cerca de los de modelos que cuestan varias veces más, lo cual constituye precisamente el argumento principal para colocar Sonnet
y no Opus en el centro de un agente especializado en programación.
Opus 5
es el modelo insignia, clasificado primero en el Índice de Inteligencia Artificial Analysis con una puntuación de 61. Llegó manteniendo sin cambios los precios de Opus, por lo que cualquier usuario ya suscrito a Opus 4.8 puede migrar simplemente modificando la cadena del modelo, sin impacto alguno en su presupuesto —una acción recomendable realizar de inmediato, pues un salto generacional de capacidad a precio constante es poco frecuente.
solo tiene sentido en la parte más alta de la curva de dificultad. A $50 por cada millón de
tokens de salida, su costo es aproximadamente cinco veces mayor que el de Opus en el lado de la salida, por lo que enrutar solicitudes habituales
hacia él consume presupuesto sin aportar ganancias medibles. Resérvelo para tareas en las que una respuesta incorrecta resulta
Fable 5 costosa: agentes multietapa sin supervisión, investigación profunda o refactorizaciones en bases de código extensas.
El patrón eficaz consiste en utilizar un enrutador —con Haiku como primera instancia y escalando únicamente a Sonnet u Opus cuando
falla una comprobación de confianza. Los equipos que monitorizan su mezcla de tokens suelen descubrir que la salida es
donde realmente se genera la factura, y que limitar
y trasladar los borradores iniciales
a una categoría más económica ahorra más que cualquier técnica de compresión de indicaciones (prompts).
Tres aspectos de la fijación de precios de Claude que suelen sorprender a los usuarios max_tokens El precio de Sonnet 5 es temporal.
La tarifa de $2/$10 es introductoria y vigente
hasta el 31 de agosto de 2026, tras lo cual entrará en vigor la tarifa estándar de $3/$15. Esto representa un aumento del 50 %, que se aplicará automáticamente a cualquier carga de trabajo calculada sobre la cifra actual. Si usted
está modelando la economía unitaria de un producto que se lanzará este año, hágalo con base en $3/$15 y considere la tarifa actual como un descuento.
El modo Rápido (Fast) de Opus 5 duplica ambas tarifas.
La versión exclusiva para API del nivel Rápido factura a razón de
$10/$50 en lugar de $5/$25. Solo justifica dicho costo cuando la latencia es fundamental para el producto —asistentes interactivos de programación, bucles de agentes en tiempo real donde el usuario espera una respuesta. Para trabajos por lotes, agentes nocturnos
y cualquier tarea encolada, el modo estándar ofrece la misma inteligencia por la mitad de precio.
No existe una prima por contexto extendido. Esta es la ventaja discreta frente a los competidores.
Claude Opus 4.8 aplica la misma tarifa a su contexto de 1 millón de tokens, desde el primer token hasta el
millonésimo. Varios modelos competidores incrementan progresivamente la tarifa de entrada una vez que el prompt supera cierto umbral —
GPT-5.6 Sol cobra el doble por la entrada y un 50 % más por la salida a partir de los 272K tokens, y Gemini 3.1 Pro duplica aproximadamente
la tarifa de entrada a partir de los 200K. Esto hace impredecible el presupuesto para sus funciones de contexto amplio, pues el mismo recurso tiene un costo distinto según la cantidad de texto que el usuario haya pegado. Con
Claude, puede dimensionar sus prompts según lo que genere la mejor respuesta, y no según un «precipicio» arbitrario en la estructura tarifaria.
¿Cuánto cuesta la API de Claude?
Los precios de la API de Claude van desde $1,80 por cada millón de tokens combinados (blended) en Claude Haiku 4.5 hasta $18,00 en Claude Fable 5. La tarifa combinada asume una proporción de 4:1 entre tokens de entrada y salida. La entrada y la salida se facturan por separado, y la salida siempre es la más cara.
¿Cuál es el modelo Claude más económico?
because the same feature costs a different amount depending on how much a user pasted in. With
Claude you can size prompts around what produces the best answer rather than around a pricing
cliff.
Preguntas frecuentes
How much does the Claude API cost?
Claude API pricing runs from $1.80 per 1M blended tokens on Claude Haiku 4.5 up to $18.00 on Claude Fable 5. Blended assumes a 4:1 input-to-output mix. Input and output are billed separately, and output is always the more expensive side.
What is the cheapest Claude model?
Claude Haiku 4.5, a $1,00 por cada millón de tokens de entrada y $5,00 por cada millón de tokens de salida. Una carga de trabajo mensual de un equipo pequeño de 20 millones de tokens de entrada y 5 millones de tokens de salida cuesta aproximadamente 45 dólares.
¿Cuánto cuesta Claude al mes?
Con 20 millones de tokens de entrada y 5 millones de tokens de salida al mes, Claude Haiku 4.5 cuesta aproximadamente 45 dólares, mientras que Claude Fable 5 cuesta unos 450 dólares. Un proyecto secundario con 1 millón de tokens de entrada y 0,25 millones de tokens de salida cuesta solo una fracción de esa cantidad. Utilice la calculadora de costos de la API de IA para estimar sus propios volúmenes.
¿Es Claude más barato que Mistral AI?
En los precios de nivel de entrada, Claude comienza en 1,80 dólares por cada millón de tokens combinados, mientras que Mistral AI comienza en 0,0220 dólares para Mistral 7B. Mistral AI representa el punto de entrada más económico, aunque las capacidades difieren: compárelos ambos en el ranking antes de cambiar.
¿Por qué Claude cobra más por los tokens de salida que por los de entrada?
Los tokens de salida se generan uno a uno y no pueden agruparse (batched) como sí puede hacerse con un prompt, por lo que su procesamiento resulta más costoso. Por eso, las cargas de trabajo intensivas en prompts —como la recuperación de información o la clasificación— son mucho más económicas que las centradas en la generación, y por eso el precio combinado resulta más relevante que el precio publicitario de entrada.
Los precios indicados corresponden a las tarifas oficiales publicadas para la API principal de cada modelo y se actualizan conforme los proveedores las modifiquen. No incluyen descuentos por volumen, procesamiento por lotes (batch) ni caché de entradas. Última revisión: agosto de 2026.

