OpenAI

GPT-5.6 Luna

O tier de volume e baixa latência da família GPT-5.6 (US$1/US$6 por M): classificação, extração, roteamento, rascunho.

O barato que confere: US$0,42 pela bateria inteira — 22× mais barato que o Opus. Compensa tamanho com iteração (14 rounds no sistema solar via exec). Artefatos compactos (258-294 linhas).

4/4 runs auditados: single-shot, prompt verbatim, sem subagentes, sem skills, zero violações.

ranking geral
#8 · score 0,837
julgamento cego (scores.json)
preço de entrada
$1 / 1M tokens
preço de saída
$6 / 1M tokens
custo total medido
$1,20
em 9 de 9 runs
vereditos
6 entregou 3 defeitos
painel cego, rubrica v2
janela de contexto
1,5M tokens
⚠️ reportado por 2 fontes secundárias para a família GPT-5.6; página oficial da OpenAI retornou 403 — sem confirmação primária
saída máxima
lançamento
09/07/2026
cache
write 1,25× / read 0,10×
OpenAI confirmou: escrita a 1,25× e leitura com 90% de desconto — mesma mecânica da Anthropic

Benchmarks oficiais

BenchmarkScoreFonteNota
Terminal-Bench 2.1 84,3% OpenAI avaliação divulgada pela própria OpenAI, não benchmark independente; empata com o Claude Mythos 5 (84,3%)

números auto-reportados pelos vendors — o placar deste site mede outra coisa: se o app entrega.

Asteriscos

  • Anunciado em 26/06/2026; GA em 09/07/2026, após liberação de restrições pelo governo dos EUA em 08/07/2026 (reportado pela Axios).
  • Contexto de 1,5M tokens é ⚠️ reportado — sem confirmação em fonte primária (página oficial da OpenAI retornou 403).
  • Limite de saída (max output) não encontrado em nenhuma fonte.
  • ID de API provável gpt-5.6-luna — ⚠️ inferido do padrão do GPT-5.5, não confirmado em doc oficial.
  • Números de Terminal-Bench divulgados pela própria OpenAI — tratar como auto-reportado.

Comportamento medido (v0)

ainda não auditado nesta bateria.

ainda não auditado — Codex CLI do Overclock listava só gpt-5.5 na data do dossiê; runs entram quando o provider subir

Runs na bateria

001 · sistema-solar-3d 3D interativo Entregou abrir ↗
▶ carregar preview
custo$0,31 tokens out34.148 idas9 duração10m 32s score0,91 acabamento1/1 tokens input_uncached40.309 tokens cache_read275.968 tokens cache_write0

Run do teste 001 (sistema solar 3D): 14 rounds, 325s, US$0.17. Ferramentas: exec×13. Artefato de 294 linhas. Sem dependência externa.

fairnessauditado, single-shot, prompt verbatim, sem subagentes, sem skills

002 · site-apple clone de site Defeitos abrir ↗
▶ carregar preview
custo$0,22 tokens out21.045 idas14 duração6m 38s score0,68 acabamento1/1 tokens input_uncached24.643 tokens cache_read59.136 tokens cache_write0

Run do teste 002 (clone da home da Apple): 5 rounds, 178s, US$0.09. Ferramentas: exec×4. Artefato de 277 linhas. Sem dependência externa.

fairnessauditado, single-shot, prompt verbatim, sem subagentes, sem skills

003 · fisica-mouse física/canvas Entregou abrir ↗
▶ carregar preview
custo$0,13 tokens out14.975 idas8 duração4m 55s score0,92 acabamento1/1 tokens input_uncached20.044 tokens cache_read52.992 tokens cache_write0

Run do teste 003 (física de bolinhas): 5 rounds, 113s, US$0.06. Ferramentas: exec×4. Artefato de 258 linhas. Sem dependência externa.

fairnessauditado, single-shot, prompt verbatim, sem subagentes, sem skills

004 · fps jogo 3D Defeitos abrir ↗
▶ carregar preview
custo$0,25 tokens out29.652 idas10 duração9m 10s score0,68 acabamento1/1 tokens input_uncached19.023 tokens cache_read93.696 tokens cache_write0

Run do teste 004 (jogo FPS): 6 rounds, 210s, US$0.10. Ferramentas: exec×5. Artefato de 278 linhas. Usa lib externa: cdn.jsdelivr.net.

fairnessauditado, single-shot, prompt verbatim, sem subagentes, sem skills

101 · caca-bug debug Entregou abrir ↗
▶ carregar preview
custo$0,02 tokens out975 idas4 duração30s score0,92 acabamento1/1
103 · feature-alheia feature em código existente Entregou abrir ↗
▶ carregar preview
custo$0,03 tokens out2.050 idas6 duração44s score0,94 acabamento1/1
104 · css-mobile CSS responsivo Defeitos abrir ↗
▶ carregar preview
custo$0,04 tokens out2.871 idas6 duração57s score0,73 acabamento1/1
105 · revisar-codigo code review Entregou abrir ↗
▶ carregar preview
custo$0,09 tokens out7.688 idas6 duração2m 25s score0,86 acabamento1/1
108 · dado-sujo dados Entregou abrir ↗
▶ carregar preview
custo$0,11 tokens out9.873 idas12 duração3m 10s score0,90 acabamento1/1

Duelos diretos

Perguntas frequentes

Quanto custa GPT-5.6 Luna pra programar?

Preço de tabela: $1/1M tokens de entrada e $6/1M de saída. Na prática, medimos $1,20 em 9 tarefas reais de vibe coding — média de $0,13 por tarefa.

GPT-5.6 Luna vale a pena pra código?

No julgamento cego, GPT-5.6 Luna ficou em #8 no ranking geral (score 0,837), com 6 entregas limpas, 3 com defeitos e 0 quebradas em 9 testes.