duelo direto
GPT-5.6 Luna vs GLM 5.2
Placar 6×3 em 9 testes reais de vibe coding — julgamento cego, custo medido, código auditável.
Placar por teste
6 × 3
GPT-5.6 Luna × GLM 5.2
Custo da bateria
$1,20 vs $1,21
soma dos runs medidos
Vencedor geral
GPT-5.6 Luna
score do ranking cego
| Teste | GPT-5.6 Luna | GLM 5.2 | Vencedor |
|---|---|---|---|
| 001 3D interativo | Entregou $0,31 · 10m 32s · score 0,91 | Defeitos $0,11 · 3m 7s · score 0,73 | GPT-5.6 Luna |
| 002 clone de site | Defeitos $0,22 · 6m 38s · score 0,68 | Defeitos $0,10 · 3m 17s · score 0,72 | GLM 5.2 |
| 003 física/canvas | Entregou $0,13 · 4m 55s · score 0,92 | Entregou $0,14 · 5m 9s · score 0,91 | GPT-5.6 Luna |
| 004 jogo 3D | Defeitos $0,25 · 9m 10s · score 0,68 | Defeitos $0,19 · 5m 57s · score 0,70 | GLM 5.2 |
| 101 debug | Entregou $0,02 · 30s · score 0,92 | Entregou $0,04 · 35s · score 0,90 | GPT-5.6 Luna |
| 103 feature em código existente | Entregou $0,03 · 44s · score 0,94 | Entregou $0,09 · 1m 31s · score 0,84 | GPT-5.6 Luna |
| 104 CSS responsivo | Defeitos $0,04 · 57s · score 0,73 | Entregou $0,08 · 2m 46s · score 0,93 | GLM 5.2 |
| 105 code review | Entregou $0,09 · 2m 25s · score 0,86 | Entregou $0,09 · 3m 14s · score 0,82 | GPT-5.6 Luna |
| 108 dados | Entregou $0,11 · 3m 10s · score 0,90 | Entregou $0,37 · 8m 25s · score 0,65 | GPT-5.6 Luna |
veredito e custo de results.json · score por teste de scores.json (qualidade 50% · preço 25% · velocidade 25%)
Onde GPT-5.6 Luna leva
- Vence em 6 dos 9 testes com score consistentemente superior: 3D (0.91 vs 0.73), física (0.92 vs 0.91), dados (0.90 vs 0.65)
- Debug e feature engineering são domínios de Luna, onde GLM fica para trás em qualidade (0.92 vs 0.90, 0.89 vs 0.72)
- Custo praticamente idêntico ($1.202 vs $1.206), mas Luna entrega melhor qualidade na maioria das atividades
Onde GLM 5.2 leva
- CSS responsivo (score 0.93 vs 0.73) é o grande trunfo do GLM, apesar de 3x mais lento
- Clone de site (0.72 vs 0.68) e jogo 3D (0.70 vs 0.68) levam por margem estreita quando ambos entregam defeitos
Qual escolher
Luna é a escolha natural: custo equivalente mas qualidade superior em 6 atividades. Reserve GLM 5.2 apenas se CSS perfeito é critical path. Para maioria dos cenários de vibe coding, Luna domina.
Outros duelos
GLM 5.2 vs Fable 5
GLM 5.2 vs GPT-5.4 Mini
GLM 5.2 vs GPT-5.4
GLM 5.2 vs GPT-5.5
GLM 5.2 vs GPT-5.6 Sol
GLM 5.2 vs GPT-5.6 Terra
GLM 5.2 vs Sonnet 5
GLM 5 Turbo vs GLM 5.2
GLM 5 Turbo vs GPT-5.6 Luna
GPT-5.3 Codex Spark vs GLM 5.2
GPT-5.3 Codex Spark vs GPT-5.6 Luna
GPT-5.6 Luna vs Fable 5
GPT-5.6 Luna vs GPT-5.4 Mini
GPT-5.6 Luna vs GPT-5.4
GPT-5.6 Luna vs GPT-5.5
GPT-5.6 Luna vs GPT-5.6 Sol
GPT-5.6 Luna vs GPT-5.6 Terra
GPT-5.6 Luna vs Haiku 4.5
GPT-5.6 Luna vs Opus 4.8
GPT-5.6 Luna vs Sonnet 5
Grok 4.5 vs GLM 5.2
Grok 4.5 vs GPT-5.6 Luna
Grok Composer 2.5 Fast vs GLM 5.2
Grok Composer 2.5 Fast vs GPT-5.6 Luna
Haiku 4.5 vs GLM 5.2
Kimi K3 vs GLM 5.2
Kimi K3 vs GPT-5.6 Luna
Opus 4.8 vs GLM 5.2
Sonnet 4.6 vs GLM 5.2
Sonnet 4.6 vs GPT-5.6 Luna