duelo direto

Haiku 4.5 vs GPT-5.5

Placar 7×2 em 9 testes reais de vibe coding — julgamento cego, custo medido, código auditável.

Placar por teste 7 × 2 Haiku 4.5 × GPT-5.5
Custo da bateria $0,53 vs $13,40 soma dos runs medidos
Vencedor geral Haiku 4.5 score do ranking cego
Teste Haiku 4.5 GPT-5.5 Vencedor
001 3D interativo Entregou $0,06 · 1m 0s · score 0,99 Defeitos $3,29 · 17m 35s · score 0,42 Haiku 4.5
002 clone de site Entregou $0,07 · 1m 11s · score 0,99 Defeitos $1,15 · 7m 25s · score 0,61 Haiku 4.5
003 física/canvas Entregou $0,04 · 43s · score 0,99 Entregou $0,79 · 5m 17s · score 0,83 Haiku 4.5
004 jogo 3D Quebrou $0,06 · 43s · score 0,50 Entregou $6,13 · 16m 36s · score 0,63 GPT-5.5
101 debug Entregou $0,05 · 24s · score 0,92 Defeitos $0,17 · 1m 6s · score 0,46 Haiku 4.5
103 feature em código existente Entregou $0,06 · 37s · score 0,94 Entregou $0,20 · 1m 10s · score 0,81 Haiku 4.5
104 CSS responsivo Entregou $0,03 · 25s · score 0,99 Defeitos $0,77 · 3m 38s · score 0,52 Haiku 4.5
105 code review Entregou $0,07 · 1m 7s · score 0,93 Entregou $0,30 · 2m 5s · score 0,80 Haiku 4.5
108 dados Quebrou $0,10 · 58s · score 0,47 Entregou $0,59 · 3m 33s · score 0,73 GPT-5.5

veredito e custo de results.json · score por teste de scores.json (qualidade 50% · preço 25% · velocidade 25%)

Onde Haiku 4.5 leva

  • 7 de 9 testes: vence em clone, canvas, debug, feature, CSS e code review — 78% de taxa de sucesso
  • Velocidade + custo: $0.532 vs $13.398 (25× mais caro!) e 25–71s vs 218–1055s em tarefas visuais
  • Qualidade em design: scores 0.98–0.99 em clone e CSS onde GPT-5.5 falha (0.61, 0.52)

Onde GPT-5.5 leva

  • Jogo 3D: entrega completa (score 0.63) numa falha do Haiku, mas custa $6.13 e leva 996s
  • Dados (teste 108): score 0.73 onde Haiku quebrou, custo $0.59

Qual escolher

Haiku 4.5 na grande maioria: 7 de 9, 25× mais barato e 7–18× mais rápido. GPT-5.5 só para jogo 3D: se renderização complexa for crítica e custo for secundário, use GPT-5.5 (mas aceite quase 1000s de latência).

Outros duelos