Los precios de la API de Grok son de 3 USD por cada 1 millón de tokens de entrada y de 15 USD por cada 1 millón de tokens de salida en Grok 4,
lo que da un precio combinado aproximado de 5,40 USD para una mezcla típica de uso. Esto sitúa a xAI en el mismo rango que
los modelos punteros de OpenAI y Anthropic, y no en la categoría de bajo coste; una decisión estratégica que determina cuándo Grok es la opción adecuada y cuándo no lo es.
Precios de la API de Grok: todos los modelos, por cada 1 millón de tokens
Cuánto cuesta Grok al mes
| Modelos | Entrada: $/1 millón | Salida: $/1 millón | Dólares por millón combinados | Contexto |
|---|---|---|---|---|
| Grok 4 | $3.00 | $15.00 | $5.40 | 256 000 tokens |
«Combinado» es la tarifa efectiva para una proporción entrada/salida de 4:1, que es la que realmente genera una carga de trabajo típica de chat o recuperación de información. Es el valor que debe compararse entre proveedores; un precio publicitario solo para la entrada oculta el coste real del lado de la salida.
Cómo se compara Grok con otros proveedores
| Carga de trabajo | Tokens/mes | Grok 4 |
|---|---|---|
| Proyecto secundario | 1 millón de tokens de entrada / 0,25 millones de tokens de salida | $6.75 |
| Pequeño equipo | 20 millones de tokens de entrada / 5 millones de tokens de salida | $135 |
| Producción | 200 millones de tokens de entrada / 50 millones de tokens de salida | $1,350 |
Modele sus propios volúmenes en la Calculadora de costos de API de IA.
Qué obtiene por ese precio
El modelo más económico de cada proveedor, de modo que la comparación sea homogénea desde el punto de vista del coste de entrada.
| Proveedor | Modelo más económico | Dólares por millón combinados |
|---|---|---|
| Mistral AI | Mistral 7B | $0.0220 |
| Meta | Llama 3.1 8B | $0.0220 |
| Alibaba | Qwen3 8B | $0.0600 |
| Gemma 3 4B | $0.0600 | |
| Microsoft | Phi-4 | $0.0840 |
| DeepSeek | DeepSeek V4-Flash | $0.168 |
| Moonshot AI | Kimi K2.7 Code | $0.980 |
| Anthropic | Claude Haiku 4.5 | $1.80 |
| Zhipu AI | GLM 5.2 | $2.00 |
| xAI esta página | Grok 4 | $5.40 |
| OpenAI | GPT-5.6 Sol | $10.00 |
Lo más económico no equivale necesariamente al mejor valor; compruebe también las capacidades junto con el precio en la Clasificación de modelos de lenguaje grande (LLM), o explore todos los modelos disponibles en la Base de datos de modelos de IA.
Lo que obtienes por el precio
Grok 4 se lanzó el 9 de julio de 2025 como el modelo de razonamiento insignia de xAI y sucesor de
Grok 3. Combina de forma nativa el razonamiento paso a paso (chain-of-thought) con la comprensión multimodal, aceptando
entradas de texto e imágenes y generando únicamente texto, y cuenta con una ventana de contexto de 256 000 tokens. En su lanzamiento, obtuvo resultados sólidos en pruebas de razonamiento y uso de herramientas, como Humanity’s Last
Exam y ARC-AGI, gracias al acceso en tiempo real a X y a la web.
Ese acceso en tiempo real a búsquedas es su verdadera característica diferenciadora. La mayoría de los modelos punteros responden exclusivamente con base en sus datos de entrenamiento más lo que el usuario incluya en el prompt; Grok, en cambio, puede acceder directamente a información actualizada.
En cargas de trabajo donde la actualidad es un requisito imprescindible —como el monitoreo, la investigación sobre temas emergentes o cualquier tarea en la que una respuesta desactualizada equivalga a una respuesta errónea— este atributo justifica su coste de una manera que las puntuaciones en benchmarks no capturan.
El acceso es totalmente propietario: no existen pesos abiertos, y el modelo solo se ejecuta mediante la API de xAI, las aplicaciones Grok y la suscripción SuperGrok. Posteriormente, xAI ha lanzado variantes más rápidas y económicas de Grok 4; listamos únicamente los precios publicados por token para los modelos cuyos costes hemos verificado, por lo que esta página trata exclusivamente de Grok 4.
Dónde limita la ventana de contexto de 256K
La ventana de contexto constituye la limitación más evidente frente a sus competidores directos. Grok 4 ofrece 256 000 tokens, mientras que Claude, Gemini y la serie DeepSeek V4 alcanzan aproximadamente 1 millón. Para la mayoría de las aplicaciones, 256 000 tokens son más que suficientes —equivalen al tamaño de un libro extenso—, pero sí representan una restricción real en tareas como el razonamiento sobre repositorios completos, la consulta de archivos documentales extensos o aquellas cargas de trabajo que evitan deliberadamente una capa de recuperación (retrieval), especialmente considerando su precio, ya que los competidores no imponen tal limitación.
Como contrapeso, Grok no aplica una tarifa adicional por contextos largos. GPT-5.6 Sol cobra el doble por tokens de entrada y 1,5 veces más por tokens de salida cuando superan los 272 000; Gemini 3.1 Pro duplica aproximadamente el costo de entrada a partir de los 200 000 tokens. En cambio, la tarifa de Grok es fija en toda su ventana de contexto, de modo que lo que ves es exactamente lo que pagas.
¿Vale la pena pagar $5,40 por millón de tokens (precio promedio ponderado)?
Depende casi por completo de si necesitas la búsqueda en tiempo real. Evaluado únicamente según capacidad por dólar, el comparativo resulta desfavorable: la tabla interproveedor anterior muestra varios modelos a una fracción de ese costo, y los modelos insignia de código abierto ahora obtienen puntuaciones muy cercanas a las de los mejores modelos cerrados, cobrando mucho menos. Un equipo que eligiera únicamente en función del precio no optaría por Grok.
Sin embargo, evaluado según lo que hace de forma única, el cálculo cambia. El acceso en tiempo real a X y a la web en su conjunto no es una funcionalidad que pueda replicarse simplemente pagando más tokens a un proveedor más económico; requeriría construir y mantener una canalización propia de recuperación (retrieval pipeline), lo cual implica costos adicionales y sus propios modos de fallo. Si dicha funcionalidad es central para tu producto, el precio de Grok resulta razonable dentro de su categoría.
Si no es central, trata a Grok como un especialista al que enrutas solicitudes específicas, y no como tu opción predeterminada. Estima cuánto costaría esa división de tráfico en el
, y compara
la capacidad frente al precio para cada modelo en el
¿Cuánto cuesta la API de Grok?
Grok cuesta $3,00 por cada millón de tokens de entrada y $15,00 por cada millón de tokens de salida en Grok 4, lo que da un precio promedio ponderado de $5,40 por millón de tokens, asumiendo una relación típica entrada/salida de 4:1. Los tokens de entrada y salida se facturan por separado, siendo los de salida los más caros.
¿Cuánto cuesta Grok al mes?
Con 20 millones de tokens de entrada y 5 millones de tokens de salida mensuales, Grok 4 cuesta aproximadamente $135. Un proyecto secundario con 1 millón de tokens de entrada y 0,25 millones de tokens de salida cuesta solo una pequeña fracción de esa cantidad. Usa la calculadora de costos de APIs de IA para estimar tus propios volúmenes.
¿Es Grok más barato que Mistral AI?
En cuanto a los precios de entrada, Grok comienza en $5,40 por millón de tokens (precio promedio ponderado), mientras que Mistral AI empieza en $0,0220 para Mistral 7B. Mistral AI representa un punto de entrada más económico, aunque su capacidad difiere; compáralos ambos en el leaderboard antes de cambiar.
¿Por qué Grok cobra más por los tokens de salida que por los de entrada?
¿Vale la pena Grok a 5,40 dólares por solicitud combinada?
Depende casi por completo de si necesitas búsqueda en tiempo real. Evaluado únicamente según la capacidad por
dólar, la comparación resulta desfavorable: la tabla interproveedor mostrada arriba incluye varios modelos a una
fracción del costo, y las principales alternativas de código abierto ahora obtienen puntuaciones dentro de unos pocos puntos de los mejores modelos cerrados, cobrando mucho menos. Un equipo que eligiera únicamente en función del precio no optaría por Grok.
Sin embargo, al evaluarlo según lo que hace de forma única, el cálculo cambia. El acceso en tiempo real a X y a la
web en su conjunto no es una característica que puedas replicar simplemente pagando más tokens a un proveedor más económico;
tendrías que construir y mantener una canalización de recuperación, lo cual implica sus propios costos y sus propios
modos de fallo. Si dicha capacidad es fundamental para tu producto, el precio de Grok es razonable dentro de su categoría.
Si no lo es, trata a Grok como un especialista al que enrutas solicitudes específicas, en lugar de
el soporte en el que se encuentra.
Si no es central, trate a Grok como un especialista al que enruta solicitudes específicas en lugar de
un valor predeterminado. Estime cuánto costaría esa división en el
Calculadora de costos de API de IA, y compare
capacidad frente al precio para cada modelo de la
Clasificación de modelos de lenguaje grande (LLM) antes de comprometerse.
Preguntas frecuentes
¿Cuánto cuesta la API de Grok?
Grok cuesta 3,00 USD por cada millón de tokens de entrada y 15,00 USD por cada millón de tokens de salida en Grok 4, lo que equivale a un costo promedio combinado de 5,40 USD por cada millón de tokens con una proporción típica entrada-salida de 4:1. Los tokens de entrada y salida se facturan por separado, siendo los de salida los más caros.
¿Cuánto cuesta Grok al mes?
Con 20 millones de tokens de entrada y 5 millones de tokens de salida al mes, Grok 4 cuesta aproximadamente 135 USD. Un proyecto secundario con 1 millón de tokens de entrada y 0,25 millones de tokens de salida cuesta solo una fracción de esa cantidad. Utilice la calculadora de costos de la API de IA para sus propios volúmenes.
¿Es Grok más barato que Mistral AI?
En los precios de nivel de entrada, Grok comienza en 5,40 USD por cada millón de tokens combinados, mientras que Mistral AI comienza en 0,0220 USD para Mistral 7B. Mistral AI representa el punto de entrada más económico, aunque las capacidades difieren; compárelos ambos en el ranking antes de cambiar.
¿Por qué Grok cobra más por los tokens de salida que por los de entrada?
Los tokens de salida se generan uno a uno y no pueden agruparse (batched) como sí puede hacerse con un prompt, por lo que su procesamiento resulta más costoso. Por eso, las cargas de trabajo intensivas en prompts —como la recuperación de información o la clasificación— son mucho más económicas que las centradas en la generación, y por eso el precio combinado resulta más relevante que el precio publicitario de entrada.
Los precios indicados corresponden a las tarifas oficiales publicadas para la API principal de cada modelo y se actualizan conforme los proveedores las modifiquen. No incluyen descuentos por volumen, procesamiento por lotes (batch) ni caché de entradas. Última revisión: agosto de 2026.

