GPT-6 Luna é o modelo da OpenAI focado em eficiência para trabalho de alto volume e repetitivo. Seu ID de modelo de API publicado é gpt-6-luna. O modelo aceita texto e imagens como entrada e produz texto; é um modelo hospedado, não um download de código aberto. A OpenAI lista streaming, saídas estruturadas e chamada de funções entre seus recursos upstream.
Luna é uma primeira candidata para solicitações delimitadas: rótulos de tickets, respostas fundamentadas em texto recuperado ou atributos de produto. Para planos ambíguos, edições em vários arquivos ou execuções de agente mais longas, teste também o GPT-6 Sol. Selecione pelo custo da tarefa concluída, não apenas pela taxa de tokens.
| Especificação publicada |
GPT-6 Luna |
| ID do modelo da OpenAI |
gpt-6-luna |
| Janela de contexto |
1,050,000 tokens |
| Saída máxima |
128,000 tokens |
| Entrada / saída |
Texto e imagem / texto |
| Esforço de raciocínio |
none, low, medium (padrão), high, xhigh, max |
| Saídas estruturadas / streaming |
Suportado upstream |
| Ajuste fino |
Não suportado |
A janela de contexto longa não garante sucesso em uma tarefa de longo horizonte. Divida o trabalho em etapas verificáveis, salve o estado fora do prompt e conte as tentativas ao comparar custos.
Aplicações da API do GPT-6 Luna
Chat e classificação de alto volume. Encaminhe mensagens estritamente definidas para o Luna. Forneça definições de categoria ou um pequeno trecho de conhecimento e, em seguida, teste a precisão e o tempo de resposta em entradas reais.
Extração estruturada. Extraia campos de descrições de produtos ou mensagens de clientes. Solicite um esquema, valide os campos em seu aplicativo e revise casos incertos.
Etapas limitadas de codificação e agente. Explique uma função, rascunhe um teste direcionado ou resuma o resultado de uma ferramenta. Seu aplicativo executa ferramentas e testes; encaminhe alterações difíceis ou falhas repetidas para o Sol.
GPT-6 Luna vs GPT-5.6 Luna e GPT-6 Sol
A tabela mostra taxas padrão upstream de texto de contexto curto da OpenAI, não os preços da GPTProto. Consulte o painel de preços ao vivo desta página para saber a tarifa cobrada pela GPTProto. Todos os três modelos publicam uma janela de contexto de 1,050,000 tokens e uma saída máxima de 128,000 tokens.
| Modelo |
Entrada / saída OpenAI por 1M tokens |
Bom primeiro teste |
| GPT-5.6 Luna |
$0.20 / $1.20 |
Linha de base da carga de trabalho existente; mantenha-a até que os testes de migração sejam aprovados. |
| GPT-6 Luna |
$0.10 / $0.50 |
Tarefas repetíveis nas quais custo e tempo de resposta importam. |
| GPT-6 Sol |
$2.00 / $10.00 |
Tarefas que exigem raciocínio mais forte ou loops de agente mais longos. |
As tarifas de tabela do GPT-6 Luna da OpenAI são 50% menores para entrada e cerca de 58% menores para saída do que as tarifas atuais do GPT-5.6 Luna. Isso compara preços de tokens, não qualidade. Acima de 272,000 tokens de entrada, tarifas upstream mais altas de contexto longo se aplicam à solicitação inteira; verifique as regras de cobrança da GPTProto para grandes trabalhos.
Migrando um Fluxo de Trabalho Repetitivo para o Luna
Execute uma amostra representativa de tarefas no GPT-5.6 Luna, GPT-6 Luna e Sol. Compare respostas aceitas, tentativas, latência e cobrança total. Defina uma regra de escalonamento. Para chamadas de ferramentas com raciocínio habilitado, verifique o endpoint: a OpenAI recomenda Responses, enquanto Chat Completions permite chamada de funções apenas com reasoning_effort: "none". Verifique a rota da GPTProto no Quick Start.