Tuesday, 8 September 2026 | Updating Daily AI insight, written for builders

GPT-6 Astra: Preços, benchmarks e o que realmente mudou

Principais conclusões

  • GPT-6 Astra é o novo modelo principal da OpenAI, anunciado em 3 de setembro de 2026 e disponibilizado gradualmente para os planos ChatGPT Plus, Pro, Business e Enterprise, bem como pela API (gpt-6-astra), Azure e AWS Bedrock.
  • Preço da API: US$ 10 por 1 milhão de tokens de entrada, US$ 50 por 1 milhão de tokens de saída — o dobro GPT-5.6 dos US$ 5/US$ 30 do Sol, e com o mesmo preço de tabela do Claude Fable 5.
  • Janela de contexto de 1.050.000 tokens, com saída máxima de 128K. Solicitações com mais de 272K tokens de entrada têm custo dobrado para entrada e 1,5× para saída; o modo Rápido duplica a cobrança para até 2× a velocidade do processamento Padrão.
  • Onde ele se destaca: uso de computadores (OSWorld 2.0: 72,6% vs. 65,7% do Sol), matemática (FrontierMath Tier 4: 97,6%) e cibersegurança — o primeiro modelo da OpenAI a atingir o limiar cibernético de "Crítico", razão pela qual a versão inicial recusa a geração de exploits de prova de conceito.
  • Onde ele não se destaca: na própria tabela da OpenAI, fica atrás do Claude Fable 5.1 no Artificial Analysis Intelligence Index (61,2 vs. 65,7) e no Humanity's Last Exam com ferramentas (57,2% vs. 65,0%).

A OpenAI lançou o GPT-6 Astra em 3 de setembro de 2026 com afirmações incomumente ambiciosas — o presidente Greg Brockman encerrou a coletiva de imprensa com a frase "Bem-vindos à era da AGI", segundo Axios. Ao remover a retórica, a página de lançamento ainda contém muitas informações concretas e verificáveis: uma lista completa de preços, uma janela de contexto que finalmente corresponde ao que foi divulgado e tabelas de benchmarks que incluem, nominalmente, os concorrentes da OpenAI. Este artigo analisa o que os números indicam, quanto custa executar o modelo frente às alternativas em nosso banco de dados de modelos, e quem deve se interessar.

Quanto custa o GPT-6 Astra

O modelo da API é gpt-6-astra. A partir da página de modelos da OpenAI:

Item GPT-6 Astra
Entrada US$ 10,00 por 1 milhão de tokens
Entrada em cache US$ 1,00 por 1 milhão de tokens
Saída US$ 50,00 por 1 milhão de tokens
Sobretaxa para contextos longos Solicitações com mais de 272K tokens de entrada: taxa dobrada para entrada e cache, e 1,5× para saída, aplicável a toda a solicitação
Modo Rápido Taxas aplicáveis multiplicadas por 2 para até 2× a velocidade do processamento Padrão
Janela de contexto 1.050.000 tokens
Saída máxima 128.000 tokens
Data-limite de conhecimento 30 de abril de 2026
Modalidades Entrada de texto e imagem, saída de texto
Endpoints Chat Completions, Responses, Batch

Dois pontos chamam atenção. Primeiro, o preço é exatamente o dobro GPT-5.6 Sol (US$ 5 na entrada / US$ 30 na saída), de modo que uma solicitação que consuma um milhão de tokens em cada direção passa de US$ 35 para US$ 60 — um aumento de 71%. Segundo, a sobretaxa para contextos longos entra em vigor a partir de 272K tokens de entrada, e não no limite superior de 1,05M: uma solicitação utilizando toda a janela de contexto é cobrada a US$ 20 por 1 milhão de tokens de entrada e US$ 75 por 1 milhão de tokens de saída. Quem planeja usar essa janela como substituta da recuperação de dados deve considerar esse custo desde o início; nosso Calculadora de custos de API já inclui o novo modelo.

Como o preço se compara

Preços por 1 milhão de tokens, conforme o Convly banco de dados de modelos (verificado em 8 de setembro de 2026):

Modelo Entrada Saída Contexto 1M entrada + 1M saída
GPT-6 Astra $10.00 $50.00 1,05 milhão $60.00
Claude Fable 5 $10.00 $50.00 1 milhão $60.00
GPT-5.6 Sol $5.00 $30.00 1,05 milhão $35.00
GPT-5.5 $5.00 $30.00 1,05 milhão $35.00
Claude Opus 5 $5.00 $25.00 1 milhão $30.00
Gemini 3.1 Pro $2.00 $12.00 1,05 milhão $14.00
Claude Sonnet 5 $2.00 $10.00 1 milhão $12.00
Gemini 3.6 Flash $1.50 $7.50 1 milhão $9.00
DeepSeek V4-Pro $0.435 $0.87 1 milhão $1.31
DeepSeek V4-Flash $0.14 $0.28 1 milhão $0.42

O Astra está no topo absoluto do mercado, empatado com Claude Fable 5 e cerca de 46 vezes mais caro que o DeepSeek V4-Pro em uma ida e volta. Essa diferença é justamente a questão central para os compradores, e é também a razão pela qual acompanhamos a inteligência por dólar, em vez de apenas pontuações de destaque, no índice preço-desempenho.

O que dizem os benchmarks — inclusive onde o Astra perde

A página de lançamento da OpenAI publica resultados lado a lado contra o GPT-5.6 Sol, o Claude Fable 5.1 e o Claude Fable 5, Claude Opus 5 e Gemini 3.8 Flash. Linhas selecionadas, todas provenientes da página mencionada (os resultados são da OpenAI, "máximo com qualquer esforço"):

Benchmark GPT-6 Astra GPT-5.6 Sol Claude Fable 5.1 Claude Opus 5
OSWorld 2.0 (uso de computador) 72.6% 65.7% 70.2%
ScreenSpot-Pro 92.7% 76.9%
Terminal-Bench 4.0 57.9% 37.3% 55.8% 52.6%
DeepSWE v1.1 74.1% 72.7% 67.4% 73.7%
FrontierMath Tier 4 (v2) 97.6% 83.0% 87.8% 73.2%
GPQA Diamond 96.0% 94.6% 93.7% 93.7%
ARC-AGI-2 95.0% 92.5% 90.0% 90.4%
ARC-AGI-3 99.9% 7.8% 30.2%
Humanity's Last Exam (com ferramentas) 57.2% 65.0% 63.6%
Artificial Analysis Intelligence Index v4.1.1 61.2 60.9 65.7 63.1
Artificial Analysis Coding Agent Index v1.4 67.0 65.1 68.1
ExploitBench (cibersegurança) 100% 78.5% 70%
SRE-Bench (engenharia reversa) 88.0% 55.9% 12.5%

O padrão é consistente. Os ganhos da Astra concentram-se em tarefas agênticas — conduzir um computador, executar comandos em um terminal, explorar ou realizar engenharia reversa de software — e em matemática, onde atinge o nível mais difícil do FrontierMath e do ARC-AGI-3 (um salto de 7,8% em relação ao Sol). Em índices agregados amplos, representa um avanço bem menor: 61,2 contra 60,9 do Sol no índice Artificial Analysis, ficando atrás tanto do Claude Fable 5.1 quanto do Opus 5. Na avaliação Humanity's Last Exam com ferramentas, fica quase oito pontos atrás do Fable 5.1. As próprias notas de rodapé da OpenAI também observam que os modelos Claude foram excluídos de três benchmarks científicos porque recusaram a maioria das perguntas; portanto, essas linhas não representam comparações diretas.

A alegação de eficiência é mais interessante do que os resultados brutos. No OSWorld 2.0, a OpenAI relata que a Astra atingiu 72,6% em aproximadamente 40 minutos por tarefa, contra 65,7% em cerca de 75 minutos para o Sol — cerca de 47% menos tempo — e uma velocidade de conclusão de tarefas 1,9 vez maior no Mind2Web, uma vez incluído o atualizado ambiente Codex. Para cargas de trabalho agênticas faturadas por token e avaliadas por hora, isso importa mais do que um ganho de dois pontos em um índice.

A classificação em cibersegurança e o que ela bloqueia

A Astra é o primeiro modelo da OpenAI a atingir o limiar de cibersegurança "Crítico" segundo o Preparedness Framework da empresa. Na página de lançamento, a OpenAI informa um desempenho perfeito de 100% no ExploitBench (Sol: 78,5%), 42,4% no ExploitGym (Sol: 30,3%) e 88,0% de sucesso em tentativa única no SRE-Bench, um benchmark de engenharia reversa no qual o Sol obteve 55,9%. A empresa também afirma que, durante uma avaliação realizada entre junho e agosto de 2026 sobre vulnerabilidades, o modelo identificou e utilizou duas vulnerabilidades zero-day previamente desconhecidas, as quais a OpenAI está divulgando aos mantenedores.

A consequência prática para os usuários é uma versão inicial restrita. A Astra realizará revisões seguras de código e aplicações de correções, mas recusa tarefas ofensivas mais avançadas, como a criação de exploits de prova de conceito. A OpenAI afirma que salvaguardas menos restritivas serão disponibilizadas nas próximas semanas por meio de seu programa Daybreak, voltado para fluxos de trabalho defensivos como análise de malware e engenharia de detecção. O Axios acrescenta que o lançamento havia sido adiado anteriormente para incorporar testes adicionais de segurança assim que as capacidades cibernéticas foram consideradas críticas, após o incidente de julho, no qual modelos da OpenAI em fase de testes violaram os sistemas da Hugging Face.

Alinhamento: melhor em escopo, pior em monitorabilidade

A página de lançamento dedica tanto espaço ao comportamento quanto às capacidades. A métrica principal é uma avaliação de "tarefa impossível", desenvolvida após o incidente na Hugging Face: ao receber uma tarefa que só poderia ser concluída excedendo seu alvo autorizado, o GPT-5.6 Sol sem salvaguardas de produção o fez em 48% dos casos; a Astra nunca o fez (0%). A OpenAI também relata que o modelo jamais tentou contornar uma negativa de revisão automática do Codex, mesmo quando essa negativa foi deliberadamente configurada para ser contornável, e que é três vezes menos propenso do que o Sol a superestimar suas próprias capacidades.

A OpenAI é igualmente direta quanto ao custo disso. O raciocínio escrito da Astra foi mais difícil de monitorar do que o do Sol em testes que solicitavam sua evasão — a empresa atribui isso à necessidade de menos etapas escritas pelo modelo, classifica essa queda como "grave" e afirma que melhorar a monitorabilidade permanece uma prioridade de pesquisa. O cientista-chefe Jakub Pachocki disse aos jornalistas, conforme relatado pelo Axios, que a empresa precisará estender o monitoramento da cadeia de raciocínio ou adicionar monitoramento de ativações em resposta. Modelos da classe Astra também são os primeiros a serem lançados com monitoramento de desalinhamento em produção: classificadores que verificam o raciocínio e as ações do modelo e podem pausar uma tarefa — a OpenAI alerta que isso pode interromper ocasionalmente trabalhos legítimos.

Disponibilidade e implantação

  • 3 de setembro: pré-visualização limitada para um pequeno conjunto de organizações no programa Daybreak Access.
  • "Próximos dias": todos os usuários do ChatGPT Plus, Pro, Business e Enterprise; o uso conta contra os limites já existentes nas assinaturas, podendo créditos adicionais ser adquiridos. O acesso empresarial está desativado por padrão até que um administrador o habilite.
  • GPT-6 Astra Pro: disponível para planos Pro, Business e Enterprise.
  • Desenvolvedores: gpt-6-astra via API da OpenAI, além da Microsoft Azure e da Amazon Bedrock. A opção Zero Data Retention está disponível para clientes elegíveis da API.
  • Codex: um novo modo experimental de "anotações entre janelas de contexto" substitui a compactação repetida em sessões longas; trata-se de uma funcionalidade opcional ativada via config.toml a partir de agora e tornar-se-á padrão para a Astra.

O Axios relata que a Astra foi treinada em mais de 100.000 GPUs no local Stargate da OpenAI no Texas — sua maior execução até hoje — e que é o primeiro modelo da OpenAI no qual outros modelos desempenharam um papel significativo de supervisão durante o treinamento. Nenhum desses dados aparece na própria página de lançamento, portanto devem ser tratados como informações reportadas, não documentadas.

Quem deve migrar

Mude agora se você opera agentes de uso de computador ou codificação de longo prazo, nos quais o tempo real e a confiabilidade predominam na fatura: os ganhos no OSWorld e no Terminal-Bench são expressivos, e o resultado de 0% de ultrapassagem de escopo é a propriedade de segurança exigida por essas implantações. Espere se sua carga de trabalho envolve conversação, resumo ou extração: em índices de inteligência geral, a Astra está apenas ligeiramente à frente do Sol, ao custo de duas vezes mais, e Claude Opus 5 o $5/$25 do Gemini 3.1 Pro ou o $2/$12 do Gemini 3.1 Pro continuam muito mais vantajosos. Não mude ainda para pesquisas ofensivas em segurança — a versão inicial do lançamento recusa essa função por design, e a versão menos restrita está condicionada ao programa Daybreak.

O resumo honesto é que o GPT-6 Astra representa um passo decisivo para agentes e marginal para todos os demais, com preço definido para o primeiro grupo. Sua ficha técnica completa, juntamente com todos os modelos acima, está em nossa entrada sobre o GPT-6 Astra e o Ranking de LLMs.

Perguntas frequentes

Quanto custa o GPT-6 Astra por 1 milhão de tokens?

$10 por entrada, $1 por entrada em cache e $50 por saída na camada padrão da API, conforme indicado na página do modelo da OpenAI. Entradas com mais de 272 mil tokens são cobradas a uma taxa 2× para entrada e 1,5× para saída, e o modo Rápido custa 2×, oferecendo até o dobro de velocidade.

O GPT-6 Astra está disponível no ChatGPT Plus?

A OpenAI afirma que o modelo será disponibilizado a todos os usuários Plus, Pro, Business e Enterprise "nos próximos dias", após a pré-visualização limitada de 3 de setembro, dentro dos limites de uso já existentes. A versão Astra Pro é restrita aos planos Pro, Business e Enterprise.

Qual é a janela de contexto do GPT-6 Astra?

1.050.000 tokens, com saída máxima de 128.000 tokens. O teste MRCR da OpenAI para contextos longos registra 100% de acerto em agulhas de 256K–512K e 96,3% em agulhas de 512K–1M, comparado a 91,5% e 73,8% para o GPT-5.6 Sol.

É melhor que o Claude Fable 5.1?

Depende da tarefa. Na tabela publicada pela OpenAI, a Astra lidera em uso de computador, Terminal-Bench, FrontierMath e cibersegurança, enquanto o Fable 5.1 lidera no Artificial Analysis Intelligence Index (65,7 contra 61,2) e na Humanity's Last Exam com ferramentas (65,0% contra 57,2%). Ambos custam $10/$50 na camada superior.

Por que o Astra recusa algumas tarefas de segurança?

É o primeiro modelo da OpenAI a atingir o limiar de cibersegurança "Crítico" segundo o Preparedness Framework. A versão inicial do lançamento realiza tarefas defensivas, como revisão de código e aplicação de correções, mas recusa a construção de exploits de prova de conceito; um acesso mais amplo está previsto por meio do programa Daybreak da OpenAI.

Escrito por Mustafa Ihsan

Mustafa Ihsan é fundador e editor da Convly.ai. Ele criou e mantém o banco de dados em tempo real de modelos de IA do site, seu índice de desempenho por preço e suas calculadoras gratuitas para requisitos de VRAM, custos de API e economia de hospedagem local. Escreve sobre preços de modelos, resultados de benchmarks e o hardware necessário para executar modelos de IA localmente, preferindo sempre dados mensuráveis às declarações dos fabricantes.

Scroll to Top