Friday, 7 August 2026 | Updating Daily AI insight, written for builders

Preços da API Grok (2026): Quanto custam os modelos da xAI por 1 milhão de tokens

A precificação da API Grok é de US$ 3 por 1 milhão de tokens de entrada e US$ 15 por 1 milhão de tokens de saída no Grok 4,
o que resulta em uma taxa combinada de aproximadamente US$ 5,40 para uma mistura típica de uso. Isso posiciona a xAI na mesma faixa dos modelos de ponta da OpenAI e da Anthropic, e não na categoria de baixo custo — uma decisão estratégica que define quando o Grok é a escolha adequada e quando não é.
decisão estratégica que define quando o Grok é a escolha adequada e quando não é.
Precificação da API Grok: todos os modelos, por 1 milhão de tokens

Quanto o Grok custa por mês

ModeloEntrada: US$ por 1 milhãoSaída: US$ por 1 milhãoCusto médio ponderado por US$ 1 milhãoContexto
Grok 4$3.00$15.00$5.40256.000 tokens

O valor combinado representa a taxa efetiva para uma proporção de entrada para saída de 4:1, que corresponde ao que uma carga de trabalho típica de chat ou recuperação realmente gera. Trata-se do número a ser comparado entre provedores — um preço de entrada divulgado esconde o quanto a saída realmente custa.

Como o Grok se compara a outros provedores

Carga de trabalhoTokens/mêsGrok 4
Projeto paralelo1 milhão de tokens de entrada / 0,25 milhão de tokens de saída$6.75
Equipe pequena20 milhões de tokens de entrada / 5 milhões de tokens de saída$135
Produção200 milhões de tokens de entrada / 50 milhões de tokens de saída$1,350

Modele seus próprios volumes na Calculadora de custos de API de IA.

O que você obtém pelo preço

Modelo mais barato de cada provedor, garantindo assim uma comparação justa com base no custo de entrada.

ProvedorModelo mais baratoCusto médio ponderado por US$ 1 milhão
Mistral AIMistral 7B$0.0220
MetaLlama 3.1 8B$0.0220
AlibabaQwen3 8B$0.0600
GoogleGemma 3 4B$0.0600
MicrosoftPhi-4$0.0840
DeepSeekDeepSeek V4-Flash$0.168
Moonshot AIKimi K2.7 Code$0.980
AnthropicClaude Haiku 4.5$1.80
Zhipu AIGLM 5.2$2.00
xAI esta páginaGrok 4$5.40
OpenAIGPT-5.6 Sol$10.00

O modelo mais barato não é necessariamente o de melhor custo-benefício — verifique também sua capacidade, além do preço, no Ranking de LLMs, ou explore todos os modelos disponíveis no Banco de dados de modelos de IA.

O que você obtém pelo preço

O Grok 4 foi lançado em 9 de julho de 2025 como o modelo de raciocínio principal da xAI e sucessor do
Grok 3. Ele combina nativamente o raciocínio em cadeia de pensamento com compreensão multimodal, aceitando
entrada de texto e imagens e gerando saída em texto, além de incluir uma janela de contexto de 256.000 tokens. No
lançamento, obteve resultados sólidos em benchmarks de raciocínio e uso de ferramentas, como o Humanity’s Last
Exam e o ARC-AGI, impulsionados pelo acesso em tempo real ao X (antigo Twitter) e à web.

Esse acesso em tempo real à busca é o verdadeiro diferencial. A maioria dos modelos de ponta responde com base nos
dados de treinamento mais o que você fornece no prompt; o Grok, por sua vez, pode acessar diretamente informações atualizadas.
Para cargas de trabalho em que a atualidade é essencial — monitoramento, pesquisa sobre temas emergentes,
ou qualquer cenário em que uma resposta desatualizada equivale a uma resposta incorreta — esse recurso vale a pena pagar,
de um modo que os resultados dos benchmarks não conseguem capturar.

O acesso é inteiramente proprietário. Não há pesos abertos, e o modelo opera exclusivamente por meio da
API da xAI, dos aplicativos Grok e da assinatura SuperGrok. Posteriormente, a xAI lançou variantes mais rápidas e de menor custo
do Grok 4; listamos apenas preços publicados por token para modelos cujos valores verificamos, portanto
esta página trata especificamente do Grok 4.

Onde a janela de contexto de 256K se torna limitante

A janela de contexto é a limitação mais evidente frente aos principais concorrentes. O Grok 4 oferece 256.000
tokens, enquanto Claude, Gemini e a linha DeepSeek V4 atingem aproximadamente 1 milhão. Para a maioria
das aplicações, 256K é mais do que suficiente — equivale ao tamanho de um livro extenso. Contudo, para raciocínio
abrangendo repositórios inteiros, arquivos de documentos longos ou cargas de trabalho que deliberadamente evitam uma camada de recuperação,
essa restrição é real, especialmente considerando seu ponto de preço, no qual concorrentes não impõem tal limitação.

A contrapartida é que o Grok não cobra um valor adicional por longos contextos. O GPT-5.6 Sol cobra o dobro para entrada e 1,5x para saída acima de 272K tokens; o Gemini 3.1 Pro duplica aproximadamente o custo da entrada acima de 200K. A tarifa do Grok é
fixa em toda a sua janela de contexto, ou seja, o que você vê é exatamente o que paga.
fixo em toda a sua janela, portanto o que você vê é o que você paga.

O Grok vale mesmo US$ 5,40 por milhão de tokens (valor médio)?

Isso depende quase inteiramente de você precisar do recurso de busca em tempo real. Avaliado estritamente pela capacidade por dólar, a comparação é desfavorável: a tabela interprovedora acima mostra diversos modelos a uma fração desse custo, e os modelos de ponta com pesos abertos agora obtêm pontuações próximas às dos melhores modelos fechados, cobrando muito menos. Uma equipe que escolhesse exclusivamente com base no preço não optaria pelo Grok.
Avaliado pelo que ele faz de forma única, o cálculo muda. O acesso em tempo real ao X e à web em geral não é um recurso que possa ser replicado simplesmente pagando mais tokens a um provedor mais barato — seria necessário desenvolver e manter uma infraestrutura própria de recuperação de informações, o que gera seus próprios custos e modos de falha.
Se essa capacidade for central para o seu produto, o preço do Grok é razoável dentro da faixa em que se posiciona.
Se não for central, trate o Grok como um especialista ao qual você encaminha solicitações específicas, em vez de usá-lo como padrão. Estime quanto essa divisão custaria na

, e compare
capacidade versus preço para todos os modelos na
Quanto custa a API do Grok?
O Grok custa US$ 3,00 por 1 milhão de tokens de entrada e US$ 15,00 por 1 milhão de tokens de saída no Grok 4, resultando em um custo médio de US$ 5,40 por 1 milhão de tokens, considerando uma proporção típica de 4:1 entre entrada e saída. Entrada e saída são faturadas separadamente, sendo a saída o lado mais caro.
Quanto custa o Grok por mês?

Com 20 milhões de tokens de entrada e 5 milhões de tokens de saída por mês, o Grok 4 custa cerca de US$ 135. Um projeto paralelo com 1 milhão de tokens de entrada e 250 mil tokens de saída custa apenas uma fração desse valor. Use a calculadora de custos de APIs de IA para seus volumes específicos.
O Grok é mais barato que a Mistral AI?
Calculadora de custos de API de IANa precificação de nível básico, o Grok começa em US$ 5,40 por 1 milhão de tokens (valor médio), enquanto a Mistral AI começa em US$ 0,0220 no Mistral 7B. A Mistral AI representa o ponto de entrada mais econômico, embora sua capacidade difira — compare ambos no ranking antes de migrar.
Por que o Grok cobra mais pelos tokens de saída do que pelos de entrada?
Ranking de LLMs antes de comprometer-se.

Perguntas frequentes

Quanto custa a API Grok?

A Grok custa 3,00 USD por 1 milhão de tokens de entrada e 15,00 USD por 1 milhão de tokens de saída na Grok 4, o que resulta em um custo médio de 5,40 USD por 1 milhão, considerando uma proporção típica de 4:1 entre tokens de entrada e saída. Os tokens de entrada e saída são cobrados separadamente, sendo os tokens de saída os mais caros.

Quanto custa a Grok por mês?

Com 20 milhões de tokens de entrada e 5 milhões de tokens de saída por mês, a Grok 4 custa cerca de 135 USD. Um projeto paralelo com 1 milhão de tokens de entrada e 0,25 milhão de tokens de saída custa apenas uma fração desse valor. Utilize a calculadora de custos de APIs de IA para estimar seus próprios volumes.

A Grok é mais barata que a Mistral AI?

Na precificação de nível básico, a Grok começa em 5,40 USD por 1 milhão de tokens (média ponderada), enquanto a Mistral AI começa em 0,0220 USD na Mistral 7B. A Mistral AI representa o ponto de entrada mais econômico, embora as capacidades difiram — compare ambas no leaderboard antes de migrar.

Por que a Grok cobra mais pelos tokens de saída do que pelos de entrada?

Os tokens de saída são gerados um por um e não podem ser processados em lote como um prompt, tornando seu fornecimento mais caro. É por isso que cargas de trabalho intensivas em prompts — como recuperação e classificação — são muito mais baratas de executar do que aquelas intensivas em geração, e também por que a taxa combinada é mais relevante do que o preço de entrada divulgado.

Os preços correspondem às tarifas listadas oficialmente para a principal API de cada modelo e são revisados conforme os provedores as alteram. Descontos por volume, processamento em lote ou cache de entradas não estão incluídos. Última revisão em agosto de 2026.

Scroll to Top
Featured on There's An AI For That