duelo direto
GLM 5.2 vs Sonnet 5
Placar 2×7 em 9 testes reais de vibe coding — julgamento cego, custo medido, código auditável.
Placar por teste
2 × 7
GLM 5.2 × Sonnet 5
Custo da bateria
$1,21 vs $3,22
soma dos runs medidos
Vencedor geral
GLM 5.2
score do ranking cego
| Teste | GLM 5.2 | Sonnet 5 | Vencedor |
|---|---|---|---|
| 001 3D interativo | Defeitos $0,11 · 3m 7s · score 0,73 | Defeitos $0,25 · 1m 18s · score 0,73 | Sonnet 5 |
| 002 clone de site | Defeitos $0,10 · 3m 17s · score 0,72 | Entregou $0,22 · 1m 37s · score 0,98 | Sonnet 5 |
| 003 física/canvas | Entregou $0,14 · 5m 9s · score 0,91 | Entregou $0,18 · 1m 6s · score 0,97 | Sonnet 5 |
| 004 jogo 3D | Defeitos $0,19 · 5m 57s · score 0,70 | Defeitos $0,28 · 1m 56s · score 0,73 | Sonnet 5 |
| 101 debug | Entregou $0,04 · 35s · score 0,90 | Entregou $0,18 · 29s · score 0,80 | GLM 5.2 |
| 103 feature em código existente | Entregou $0,09 · 1m 31s · score 0,84 | Entregou $0,18 · 46s · score 0,86 | Sonnet 5 |
| 104 CSS responsivo | Entregou $0,08 · 2m 46s · score 0,93 | Defeitos $1,28 · 10m 43s · score 0,25 | GLM 5.2 |
| 105 code review | Entregou $0,09 · 3m 14s · score 0,82 | Entregou $0,25 · 2m 1s · score 0,82 | Sonnet 5 |
| 108 dados | Entregou $0,37 · 8m 25s · score 0,65 | Entregou $0,40 · 2m 56s · score 0,81 | Sonnet 5 |
veredito e custo de results.json · score por teste de scores.json (qualidade 50% · preço 25% · velocidade 25%)
Onde GLM 5.2 leva
- Debug (0.90 vs 0.80): 12.5% superior, GLM 4x mais barato ($0.04 vs $0.18)
- CSS responsivo (0.93 vs 0.25): abismo — Sonnet quebra completamente (score 0.25 após 643s e $1.28)
Onde Sonnet 5 leva
- Clone de site (0.98 vs 0.72): 36% superior, Sonnet entrega pleno
- Física/Canvas (0.97 vs 0.91): 6.5% acima, 4.7x mais rápido (66s vs 309s)
- 3D interativo (empatado 0.73, mas Sonnet entrega; GLM defeito) — Sonnet 2.3x mais rápido
- Jogo 3D (0.73 vs 0.70): 4.2% melhor mesmo ambos frágeis
- Feature em código (0.80 vs 0.72): 11% superior, 2x mais rápido
- Code review (0.82 vs 0.82): praticamente empatado
- Dados (0.81 vs 0.65): 24.6% superior, 2.9x mais rápido
Qual escolher
GLM 5.2 para orçamento apertado (73% mais barato, $1.21 vs $3.22) se projeto tolera risco em clone/dados — consegue debug rápido e CSS impecável. Sonnet 5 é solução equilibrada: vence 7/9 com velocidade 2-5x melhor em média, melhor em qualidade (clone 98%, dados 81%), único fraco é CSS (evitar). Sonnet recomendado para produção; GLM para prototipos ou análise cuidadosa onde você arbitra os pontos fracos.
Outros duelos
GLM 5.2 vs Fable 5
GLM 5.2 vs GPT-5.4 Mini
GLM 5.2 vs GPT-5.4
GLM 5.2 vs GPT-5.5
GLM 5.2 vs GPT-5.6 Sol
GLM 5.2 vs GPT-5.6 Terra
GLM 5 Turbo vs GLM 5.2
GLM 5 Turbo vs Sonnet 5
GPT-5.3 Codex Spark vs GLM 5.2
GPT-5.3 Codex Spark vs Sonnet 5
GPT-5.6 Luna vs GLM 5.2
GPT-5.6 Luna vs Sonnet 5
GPT-5.6 Terra vs Sonnet 5
Grok 4.5 vs GLM 5.2
Grok 4.5 vs Sonnet 5
Grok Composer 2.5 Fast vs GLM 5.2
Grok Composer 2.5 Fast vs Sonnet 5
Haiku 4.5 vs GLM 5.2
Haiku 4.5 vs Sonnet 5
Kimi K3 vs GLM 5.2
Kimi K3 vs Sonnet 5
Opus 4.8 vs GLM 5.2
Opus 4.8 vs Sonnet 5
Sonnet 4.6 vs GLM 5.2
Sonnet 4.6 vs Sonnet 5
Sonnet 5 vs Fable 5
Sonnet 5 vs GPT-5.4 Mini
Sonnet 5 vs GPT-5.4
Sonnet 5 vs GPT-5.5
Sonnet 5 vs GPT-5.6 Sol