Mesma API, escalonamento em uma linha
A Luna roda no mesmo endpoint e schema que Sol e Terra. Roteie tráfego em volume pelo gpt-5.6-luna e depois escale requisições difíceis para um nível mais forte alterando uma única string de modelo.
curl --request POST "https://gptproto.com/v1/chat/completions" \
--header "Authorization: Bearer $GPTPROTO_API_KEY" \
--header "Content-Type: application/json" \
--data '{
"model": "gpt-5.6-luna",
"messages": [
{
"role": "user",
"content": "Hello"
}
]
}'Chat, agentes de programação e trabalho com documentos. Preço por 1M de tokens — entrada, entrada em cache e saída são cobradas separadamente. GPTProto está 20% abaixo das tarifas oficiais.
| Cenário | Lista de OpenAI | OpenRouter | GPTProto | Economia / mês |
|---|---|---|---|---|
| Pessoal10M tokens / mês (4.8M cache) | $3.14 | $3.31 | $2.51 | −$0.63≈ $7.53 / ano |
| Equipe100M tokens / mês (48M cache) | $31.36 | $33.08 | $25.09 | −$6.27≈ $75.26 / ano |
| Empresarial500M tokens / mês (240M cache) | $156.80 | $165.42 | $125.44 | −$31.36≈ $376.32 / ano |
O nível mais rápido e de menor custo da família GPT-5.6 da OpenAI — criado para classificação, extração e chat em volume.
Mesma API, escalonamento em uma linha
A Luna roda no mesmo endpoint e schema que Sol e Terra. Roteie tráfego em volume pelo gpt-5.6-luna e depois escale requisições difíceis para um nível mais forte alterando uma única string de modelo.
O menor custo da família GPT-5.6
A US$ 0,80 / US$ 4,80 por 1M de tokens na GPTProto, gpt-5.6-luna é a forma mais barata de executar GPT-5.6 — um quinto do preço do Sol. O desconto de 20% em relação à tabela da OpenAI se acumula rapidamente em volume.
Potente para a sua classe de preço
gpt-5.6-luna corresponde ao nível nano das gerações anteriores de GPT-5, mas pontua 84,7% no Terminal-Bench 2.1 e 62,7% no SWE-Bench Pro nos resultados publicados pela OpenAI — capacidade incomum para esse preço.
Janela de contexto de 1M de tokens
A Luna compartilha o contexto de 1.050.000 tokens da família e o limite de saída de 128K. Os testes da própria OpenAI mostram que a recuperação enfraquece em profundidades extremas nesse nível — mantenha fatos críticos no início de prompts longos.
GPT 5.6 Luna é a menor camada da família GPT-5.6 da OpenAI, lançada em disponibilidade geral em 9 de julho de 2026, juntamente com gpt-5.6-sol e gpt-5.6-terra. A OpenAI a projetou para cargas de trabalho de alto volume e sensíveis a custo — a camada que substitui aproximadamente os modelos nano das gerações anteriores de GPT-5. Se você está se perguntando para que serve o acesso à API gpt 5.6 luna, a resposta curta é: qualquer tarefa em que você processe muitos tokens e o resultado seja fácil de verificar — classificação, marcação, extração, sumarização e chat de primeira linha.
A API gpt 5.6 luna da OpenAI está disponível no GPTProto com a mesma string de modelo e schema compatível com a OpenAI, cobrada de um único saldo que também cobre Sol, Terra e 200+ outros modelos.
| Especificações | gpt-5.6-luna |
|---|---|
| Provedor | OpenAI |
| Modalidade | Texto & imagem na entrada / texto na saída |
| Janela de contexto | 1,050,000 tokens |
| Saída máxima | 128,000 tokens |
| Corte de conhecimento | 16 de fevereiro de 2026 |
| Esforço de raciocínio | none / low / medium / high / xhigh / max |
| Saídas estruturadas | Modo estrito de schema JSON |
| Preço na GPTProto | $0.80 de entrada / $4.80 de saída por 1M de tokens |
| Preço oficial | $1 de entrada / $6 de saída por 1M de tokens |
| String do modelo | gpt-5.6-luna |
| Carga de trabalho | Entrada | Saída | Custo na GPTProto | Custo oficial |
|---|---|---|---|---|
| 1,000 resumos de documentos | 2M | 300K | $3.04 | $3.80 |
| Lote de classificação | 10M | 500K | $10.40 | $13.00 |
| Chatbot mensal | 50M | 10M | $88.00 | $110.00 |
Luna e Sol são os dois extremos da curva de custo-capacidade da família de modelos gpt 5.6 luna. Os números publicados:
| gpt-5.6-luna | gpt-5.6-sol | |
|---|---|---|
| Camada | Mais rápida e barata (equivalente a nano) | Carro-chefe |
| Terminal-Bench 2.1 | 84.7% | 88.8% (91.9% com ultra) |
| SWE-Bench Pro | 62.7% | 64.6% |
| Artificial Analysis Intelligence Index | 51 | 59 |
| Artificial Analysis Coding Agent Index | 74.6 | 80 |
| Comportamento em contexto longo | Degrada mais acentuadamente em profundidade (testes da OpenAI) | Recuperação mais forte da família |
| modo multiagente ultra | Não | Sim |
| Preço oficial por 1M | $1 / $6 | $5 / $30 |
| Preço na GPTProto por 1M | $0.80 / $4.80 | $4 / $24 |
Leitura honesta: Sol é cerca de 4–8 pontos melhor nos benchmarks por cinco vezes o preço. Essa troca vale a pena para execuções longas de agentes e tarefas caras de refazer; raramente vale a pena para classificação ou sumarização em massa. Um padrão comum em produção é o roteamento: use chamadas de API gpt 5.6 luna mais baratas por padrão e escale para Sol quando uma solicitação falhar na validação ou exceder um limite de complexidade. Para a opção intermediária, veja gpt-5.6-terra; a tabela completa das três camadas está na página do Sol.
Encontre respostas técnicas e dicas de integração para o modelo criativo gpt 5.6 luma, para ajudá-lo a criar aplicativos mais empáticos.
Guias, comparações e atualizações relacionadas a este modelo.
Todos os artigos
A GPT-5.6 Sol subcotiza a Claude Fable 5 em todos os eixos de preço — mas a METR sinalizou o seu reward hacking. Qual delas você implanta em 2026 depende de quem está observando.

O MiniMax M3 é bom para programação? Benchmarks independentes vs alegações do fornecedor, o custo real da API com seu salto de preço de 512K explicado, e código GPTProto executável.

Alternativas ao Claude comparadas para desenvolvedores: execute os mesmos Opus 4.8 e Sonnet 5 por ~20% menos, ou mude para DeepSeek, GLM e Grok. Preços de API de 2026 incluídos.

MiniMax M3 vs DeepSeek V4 Pro comparados em preço, benchmarks e multimodalidade. Qual modelo chinês de pesos abertos usar de fato — e a armadilha do SWE-bench que a maioria dos guias erra.