Anthropic

Fable 5

O modelo mais capaz de ampla disponibilidade da Anthropic, feito para raciocínio exigente e trabalho agêntico de longo horizonte — gêmeo com safety classifiers do Mythos 5 (mesmo motor, mesmo preço).

O frontier econômico de movimentos: 11 rounds na bateria toda, 692s, US$4,31. Padrão 1 Write + conferida rápida, sem retrabalho. Artefatos médios-grandes (873 linhas no FPS) sem dependência externa.

4/4 runs auditados: single-shot, prompt verbatim, sem subagentes, sem skills, zero violações.

ranking geral
#14 · score 0,765
julgamento cego (scores.json)
preço de entrada
$10 / 1M tokens
preço de saída
$50 / 1M tokens
custo total medido
$7,43
em 9 de 9 runs
vereditos
8 entregou 1 defeitos
painel cego, rubrica v2
janela de contexto
1M tokens
saída máxima
128k tokens
lançamento
09/06/2026
cache
write 1,25× / read 0,10×
Anthropic — fórmula universal do benchmark, dossiê §8

Benchmarks oficiais

BenchmarkScoreFonteNota
SWE-Bench Pro 80,3% Anthropic
Terminal-Bench 2.1 88,0% Anthropic * score do Mythos 5 (maior dos gêmeos); a OpenAI reporta o Fable 5 em 83,4% na tabela dela
Terminal-Bench 2.1 83,4% OpenAI número da tabela divulgada pela OpenAI para o Fable 5 (Mythos 5 = 84,3%)
FrontierCode Diamond (xhigh) 29,3% Anthropic mais que o dobro do Opus 4.8 (13,4%)
GDPval-AA 1932 Anthropic pontuação, não %
OSWorld-Verified 85,0% Anthropic
Humanity's Last Exam (com ferramentas) 64,5% Anthropic * score do Mythos 5
Humanity's Last Exam (sem ferramentas) 59,0% Anthropic * score do Mythos 5
Blueprint-Bench 2 38,6% Anthropic
ExploitBench (Cap%) 78,0% Anthropic * score do Mythos 5 — o Fable, com safety classifiers, cai pro Opus 4.8 em cyber
HealthBench Professional 66,0% Anthropic * score do Mythos 5
Score composto Artificial Analysis 60 Artificial Analysis ⚠️ reportado por fonte secundária; lidera sobre Opus 4.8 (56), GPT-5.5 (55) e Grok 4.5 (54)

números auto-reportados pelos vendors — o placar deste site mede outra coisa: se o app entrega.

Asteriscos

  • Preço US$10/US$50 por M — 2× o Opus 4.8, o mais caro da linha Claude.
  • Nas provas marcadas com * o número exibido é do Mythos 5 (gêmeo sem safety classifiers); em cyber e bio o Fable 5 faz fallback pro Opus 4.8 — na prática pontua mais perto do Opus nessas linhas.
  • Divergência de auto-reporte: Terminal-Bench 2.1 = 88,0% (Anthropic, maior dos gêmeos) vs 83,4% (OpenAI, Fable 5).
  • GA em 09/06/2026 com redeploy em 01/07/2026.
  • Scores oficiais auto-reportados pela Anthropic.

Comportamento medido (v0)

verificou no browser
3/4
idas na bateria
80

Leitura

Verificador mais agressivo da bateria: abriu o navegador no Solar, na Física e no FPS, e achou + corrigiu o próprio bug no Solar e no FPS (1 Edit cada); só no Apple escreveu e parou. Custo da bateria: $15,81 — 4,5× o Opus 4.8 e ~7× o Sonnet 5.

Runs na bateria

001 · sistema-solar-3d 3D interativo Defeitos abrir ↗
▶ carregar preview
custo$0,78 tokens out9.077 idas2 duração1m 47s score0,69 acabamento1/1 tokens input_uncached213 tokens cache_read36.596 tokens cache_write22.710

Run do teste 001 (sistema solar 3D): 3 rounds, 109s, US$0.77. Ferramentas: Write×1, Bash×1. Artefato de 340 linhas. Sem dependência externa.

fairnessauditado, single-shot, prompt verbatim, sem subagentes, sem skills

002 · site-apple clone de site Entregou abrir ↗
▶ carregar preview
custo$0,94 tokens out12.708 idas2 duração2m 31s score0,92 acabamento1/1 tokens input_uncached215 tokens cache_read19.920 tokens cache_write21.996

Run do teste 002 (clone da home da Apple): 2 rounds, 164s, US$0.99. Ferramentas: Write×1. Artefato de 730 linhas. Sem dependência externa.

fairnessauditado, single-shot, prompt verbatim, sem subagentes, sem skills

003 · fisica-mouse física/canvas Entregou abrir ↗
▶ carregar preview
custo$0,59 tokens out6.589 idas3 duração1m 28s score0,92 acabamento1/1 tokens input_uncached211 tokens cache_read19.800 tokens cache_write14.896

Run do teste 003 (física de bolinhas): 2 rounds, 77s, US$0.55. Ferramentas: Write×1. Artefato de 424 linhas. Sem dependência externa.

fairnessauditado, single-shot, prompt verbatim, sem subagentes, sem skills

004 · fps jogo 3D Entregou abrir ↗
▶ carregar preview
custo$2,11 tokens out30.648 idas3 duração6m 1s score0,87 acabamento1/1 tokens input_uncached215 tokens cache_read103.375 tokens cache_write36.728

Run do teste 004 (jogo FPS): 4 rounds, 342s, US$2.00. Ferramentas: Write×1, Bash×1, Edit×1. Artefato de 873 linhas. Sem dependência externa.

fairnessauditado, single-shot, prompt verbatim, sem subagentes, sem skills

101 · caca-bug debug Entregou abrir ↗
▶ carregar preview
custo$0,31 tokens out1.093 idas4 duração33s score0,68 acabamento1/1
103 · feature-alheia feature em código existente Entregou abrir ↗
▶ carregar preview
custo$0,49 tokens out2.864 idas10 duração1m 16s score0,65 acabamento1/1
104 · css-mobile CSS responsivo Entregou abrir ↗
▶ carregar preview
custo$0,70 tokens out6.613 idas8 duração2m 15s score0,82 acabamento1/1
105 · revisar-codigo code review Entregou abrir ↗
▶ carregar preview
custo$0,69 tokens out8.008 idas5 duração2m 13s score0,64 acabamento1/1
108 · dado-sujo dados Entregou abrir ↗
▶ carregar preview
custo$0,83 tokens out7.794 idas11 duração2m 12s score0,69 acabamento1/1

Duelos diretos

Perguntas frequentes

Quanto custa Claude Fable 5 pra programar?

Preço de tabela: $10/1M tokens de entrada e $50/1M de saída. Na prática, medimos $7,43 em 9 tarefas reais de vibe coding — média de $0,83 por tarefa.

Claude Fable 5 vale a pena pra código?

No julgamento cego, Claude Fable 5 ficou em #14 no ranking geral (score 0,765), com 8 entregas limpas, 1 com defeitos e 0 quebradas em 9 testes.