GPT-6 Astra passou de prévia limitada para disponibilidade geral na API da OpenAI. Está listado a $10 por milhão de tokens de entrada e $50 por milhão de tokens de saída para contexto curto, sem alteração em relação ao preço do anúncio.
O que mudou
Em 3 de setembro, o Astra foi descrito como uma prévia limitada para parceiros de confiança. Agora está na página pública de preços como um modelo disponível — uma virada de dias, e não das semanas ou meses que essas prévias costumam levar.
Uma restrição está documentada: o modo rápido não está disponível para o GPT-6 Astra sob residência de dados na UE. As equipes que direcionam solicitações por endpoints da UE por motivos de conformidade têm acesso ao modelo, mas não ao caminho de baixa latência.
Por que a ressalva da UE importa
A residência de dados não é um item opcional para muitas organizações europeias — é a condição sob a qual usar um provedor de modelos dos EUA é permitido. Um recurso que existe em todo lugar, exceto atrás da barreira de residência, cria uma experiência de dois níveis, em que as equipes com os requisitos mais estritos recebem o serviço mais lento.
Vale a pena interpretar isso como um sinal de infraestrutura, e não de política. O modo rápido geralmente depende de hardware específico em regiões específicas, e igualar essa presença dentro da UE leva mais tempo do que simplesmente ativar uma opção.
Onde ele se encaixa agora
A linha da OpenAI coloca o Astra a $10/$50 no topo, com o GPT-5.6 Sol a um preço promocional de $4/$20 até 21 de novembro, o Terra a $2/$12 e o Luna a $0.20/$1.20 na base. Uma diferença de 50 vezes entre o modelo mais barato e o mais caro de uma mesma família é uma faixa mais ampla do que a indústria tinha um ano atrás.
O processamento regional traz um acréscimo de 10% para modelos lançados em ou após 5 de março de 2026, então o preço na UE para o Astra é mais alto que o preço de tabela, além de mais lento.
O que fazer
Se você está avaliando o Astra a partir da Europa, faça o benchmark no endpoint de residência, e não no padrão — os números obtidos em um endpoint dos EUA não serão os números que você terá em produção. Para todos os demais, a decisão é a questão de sempre no nível de ponta: a resposta vale $50 por milhão de tokens de saída para essa tarefa específica, ou um modelo dez vezes mais barato fecha a diferença.