A OpenAI reduziu o preço do GPT-5.6 Luna, o modelo de entrada da família GPT-5.6, para US$ 0,20 por milhão de tokens de entrada e US$ 1,20 por milhão de tokens de saída. O Luna foi lançado a US$ 1 por milhão de tokens de entrada — o novo valor representa uma redução de 80% no lado da entrada.
O que mudou
Os três modelos da linha agora têm os seguintes preços: Luna a US$ 0,20 / US$ 1,20, Terra a US$ 2 / US$ 12 e Sol a US$ 5 / US$ 30 por milhão de tokens. Apenas o Luna teve alteração; Terra e Sol permanecem inalterados.
O processamento em lote (batch) custa metade da taxa padrão nos três modelos, e as solicitações de contexto longo são cobradas a aproximadamente o dobro da taxa de contexto curto — assim, o preço efetivo depende fortemente de como a carga de trabalho é estruturada, e não apenas de qual modelo é escolhido.
Onde isso se encaixa no mercado
O Luna, a US$ 0,20 na entrada, fica na mesma faixa do DeepSeek V4-Flash, a US$ 0,14, e do nível Flash-Lite do Google. Doze meses atrás, a opção mais barata e credível próxima da fronteira tecnológica custava vários dólares por milhão de tokens de entrada. O piso de preços caiu em uma ordem de magnitude, e essa queda se acelerou no último trimestre.
Por que isso importa
Para qualquer aplicação de alto volume — classificação, extração, roteamento, sumarização inicial — a conta do modelo deixa de ser o fator limitante nesses níveis de preço. Isso muda quais produtos vale a pena construir: fluxos de trabalho que eram inviáveis economicamente a US$ 1 por milhão de entradas passam a ser viáveis a US$ 0,20.
Por outro lado, o preço isolado já não diferencia mais o nível mais barato. Quando quatro fornecedores estão a poucos centavos de diferença entre si, a decisão passa a depender de latência, tratamento de contexto, confiabilidade nas chamadas de ferramentas e do comportamento do fornecedor quando precisar aumentar os preços mais adiante.
O que observar a seguir
Um corte desse tamanho geralmente indica capacidade disponível, não generosidade. A inferência fica mais barata quando um fornecedor tem hardware ocioso e uma pilha de serviço eficiente, e os preços acompanham essa realidade. A questão para quem planeja orçamentos com base nesses números é se esse piso vai se manter — o DeepSeek já declarou publicamente que seus próprios preços vão subir novamente.
A atitude prática é tratar o nível mais barato como intercambiável. Mantenha os prompts portáveis, evite depender de recursos específicos de um fornecedor nos caminhos de maior volume e refaça as comparações trimestralmente. Nesses preços, a decisão de troca deve ser guiada pela qualidade no seu próprio conjunto de avaliação, não por uma tabela de preços de lista que muda a cada poucas semanas.