Claude Fable 5.1 vs Opus 5.5: o múltiplo de preço real nos nossos logs do Claude Code
Atualizado October 10, 2026 · publicado originalmente October 10, 2026
O Claude Fable 5.1 tem preço de tabela de $10 de entrada e $50 de saída por milhão de tokens. O Opus 5.5 tem preço de tabela de $4 e $20. É o 2.5x que todo mundo cita. Está certo na manchete e errado na conta: a leitura de cache, onde um agente gasta a maior parte dos seus tokens, custa só 1.25x. Precificamos cada turno do Fable e do Opus 5.5 em quatro semanas completas dos nossos próprios logs do Claude Code para ver qual é o prêmio real.
- Preço no nosso mix real de tokens: 2.13x para turnos de estilo Opus, 2.31x para os turnos do próprio Fable. Não 2.5x.
- Custo por turno, como foi executado: um turno do Fable 5.1 custou $0.284, um turno do Opus 5.5 $0.064. Isso dá 4.4x, porque o Fable escreve cerca de 2.7x mais saída por turno no seu esforço alto padrão.
- Os benchmarks de programação favorecem o Opus 5.5: Os números próprios da Anthropic no Terminal-Bench 4.0 colocam o Opus 5.5 em 66.4% e o Fable 5.1 em 55.8%. A execução independente da Snorkel: 64.8% contra 57.9%, com a execução do Fable custando 1.3x mais.
- Os benchmarks de raciocínio favorecem o Fable: A Artificial Analysis dá ao Fable 5.1 nota 66 no seu índice de inteligência com esforço máximo, a maior nota do Claude.
- No plano Max: O Fable pode tomar até metade do seu limite semanal e o consome mais rápido. Nós o mantivemos entre 0% e 10% do uso de cada semana.
O que a Anthropic afirma
São alegações do fornecedor, citadas como publicadas ou conforme relatadas na cobertura do lançamento. Nossas medições vêm depois.
| Alegação | Fonte |
|---|---|
| O Fable 5.1 tem preço de tabela de $10 de entrada, $50 de saída, $0.25 de leitura de cache, $12.50 de escrita de 5 minutos e $20 de escrita de 1 hora, por milhão de tokens. | Página de preços da API |
| O Opus 5.5 tem preço de tabela de $4 de entrada, $20 de saída, $0.20 de leitura de cache, $5 de escrita de 5 minutos e $8 de escrita de 1 hora. | Página de preços da API |
| O Fable 5.1 é cerca de 25% mais barato que o Fable 5 em cargas típicas e até cerca de 45% mais barato em cargas agênticas, principalmente porque a leitura de cache caiu de $1.00 para $0.25. | Cobertura do lançamento (Constellation Research, NYU Shanghai RITS) |
| O Opus 5.5 tem desempenho próximo ao do Fable 5.1 e, com esforço padrão, supera o Opus 5 com esforço máximo por cerca de um quinto do custo. | Post de lançamento do Opus 5.5 |
| Terminal-Bench 4.0: Opus 5.5 com 66.4% em esforço xhigh, Fable 5.1 com 55.8%. | Post de lançamento do Opus 5.5 |
| O Fable 5.1 faz 60.9% no Humanity's Last Exam sem ferramentas e 65.0% com ferramentas. O esforço alto é o padrão dele. | Cobertura do lançamento |
| Nos planos Max, os modelos Fable podem usar até 50% do seu limite semanal, têm limite semanal próprio e consomem os limites mais rápido que outros modelos. No Pro, o Fable roda com créditos de uso pagos conforme o consumo. | Modelos Claude Fable no seu plano |
| O Claude Code usa o Opus 5.5 por padrão nos planos pagos. O Fable nunca é o padrão; você o escolhe com /model. | Documentação de configuração de modelos do Claude Code |
O que a Anthropic não publica: o quanto mais rápido o Fable esgota um limite do plano. As páginas dos planos dizem "mais rápido" e param aí.
Por que o múltiplo real é de 2.1x a 2.3x, e não 2.5x
Um turno de agente no Claude Code relê a conversa inteira do cache e depois escreve um pouco de saída nova. Nos nossos 22,411 turnos do Opus 5.5, o turno médio leu cerca de 94,000 tokens em cache e escreveu cerca de 551 tokens de saída. As leituras de cache custam 100x menos por token que a saída, mas há 170 vezes mais delas, então pesam de verdade na conta. Cinco tipos de token, cinco preços:
| Tipo de token, por milhão | Opus 5.5 | Fable 5.1 | Múltiplo |
|---|---|---|---|
| Entrada | $4.00 | $10.00 | 2.5x |
| Saída | $20.00 | $50.00 | 2.5x |
| Escrita em cache, 5 minutos | $5.00 | $12.50 | 2.5x |
| Escrita em cache, 1 hora | $8.00 | $20.00 | 2.5x |
| Leitura de cache | $0.20 | $0.25 | 1.25x |
Recalculando os tokens exatos dos nossos turnos do Opus 5.5 com as tarifas do Fable, a conta vai de $1,436 para $3,061: 2.13x. Fazendo o inverso com os nossos turnos do Fable, você obtém 2.31x; os turnos do Fable dependem mais de saída e de escritas de cache de 1 hora, então menos da conta recebe o desconto barato de leitura de cache. Quanto mais o seu agente depende de cache, mais abaixo de 2.5x você fica. Uma carga de chat puro, sem cache, fica nos 2.5x cheios.
Por turno, são 4.4x, e o preço explica só metade disso
| Por turno, nossos logs | Opus 5.5 | Fable 5.1 |
|---|---|---|
| Turnos | 22,411 | 486 |
| Tokens de saída por turno | 551 | 1,461 |
| Tokens de leitura de cache por turno | cerca de 94,000 | cerca de 94,000 |
| Tokens de escrita de cache de 1 hora por turno | 3,939 | 9,383 |
| Custo por turno ao preço de tabela próprio | $0.064 | $0.284 |
| Total, quatro semanas | $1,436 | $138 |
O tamanho do contexto era idêntico, cerca de 94,000 tokens em cache por turno nos dois casos. O que mudou foi o comportamento. O Fable escreveu 2.7x mais saída por turno e 2.4x mais cache novo. Isso é o esforço alto, padrão do Fable, pensando mais a cada passo. O preço explica cerca de 2.3x, o comportamento o resto, para 4.4x por turno.
Uma ressalva honesta: escolhemos o Fable para os turnos difíceis. Parte dessa saída extra vem da tarefa, não do modelo. Mesmo assim, a diferença por turno é o número que a sua conta enxerga.
Dados brutos: fable-5-1-vs-opus-5-5-turns.csv.
O que o dinheiro extra compra
| Benchmark | Opus 5.5 | Fable 5.1 | Quem executou |
|---|---|---|---|
| Terminal-Bench 4.0 | 66.4% (xhigh) | 55.8% | Anthropic |
| Terminal-Bench 4.0, pontuação | 64.8% | 57.9% | Snorkel, independente |
| Terminal-Bench 4.0, custo da execução | $4.7k, 8.0B tokens | $6.2k, 2.7B tokens | Snorkel, independente |
| Índice de inteligência, custo por tarefa | não estão na mesma página | 66 com esforço máximo, $3.76; 65 com xhigh, $2.72 | Artificial Analysis |
Na programação agêntica, o Opus 5.5 vence em pontuação e em custo. A execução da Snorkel mostra o padrão dos nossos logs ao contrário: o Fable usou um terço dos tokens, mas ainda custou 1.3x mais, porque cada um dos seus tokens tem preço mais alto. No índice de raciocínio geral da Artificial Analysis, o Fable 5.1 com esforço máximo é a maior nota do Claude, à frente do Opus 5 com esforço máximo (63, $2.34 por tarefa). A Artificial Analysis lista o Opus 5.5 à parte, com 51 a 56 entre os esforços médio e xhigh, por $1.34 a $3.46 a tarefa. Não vimos esses números na mesma página de comparação, então trate essa diferença como indicativa.
O que isso faz com uma semana do Claude Max
Usamos o limite semanal completo do Claude Max 5x toda semana. Com os preços de tabela de hoje (turnos do Opus 5 e do Sonnet 5 recalculados para Opus 5.5 e Sonnet 5.5), as quatro semanas valeriam $419, $761, $873 e $658. A parte do Fable nisso foi de $39, $34, $0 e $65: 9.3%, 4.5%, 0% e 9.9% de cada semana. A Anthropic permite que o Fable use até 50% de um limite semanal e diz que ele consome os limites mais rápido, mas não diz quanto. Se o plano medir perto do preço de tabela, cada turno do Fable custa cerca de quatro turnos do Opus 5.5 em cota. Se você passar metade da semana no Fable, perde cerca de 40% dos turnos que teria de outra forma.
Quando o Fable 5.1 vale 2.5x
- Use o Opus 5.5 como padrão para agentes de programação. Ele vence no Terminal-Bench por 7 a 11 pontos e custa cerca de um quarto por turno. O Claude Code já o usa por padrão.
- Troque para o Fable em raciocínio difícil pontual: uma decisão de arquitetura, uma análise de causa raiz complicada, uma revisão de especificação. Poucos turnos, alto risco, e ele lidera os benchmarks de raciocínio.
- Na API, o cache reduz a diferença. Um agente de contexto longo com alta taxa de acerto de cache paga cerca de 2.1x, não 2.5x. Um esforço menor reduz ainda mais a diferença.
- No plano Max, limite o uso. Mantenha o Fable em cerca de 10% da semana, como fizemos. Acima disso, ele começa a consumir os turnos de que você precisa para o Opus.
Para a comparação completa de planos com o Codex, veja Claude vs Codex em outubro de 2026. Para a matemática de acerto de cache por trás do preço do Fable, veja o modelo de custo do Fable 5.1.
O que isto não mostra
Estes são os logs de um único usuário intenso. O Fable rodou 486 turnos contra 22,411 do Opus 5.5, e escolhemos o Fable para os turnos mais difíceis, então o custo por turno dele fica enviesado para cima. Os valores em dólar são o valor de tabela da API, não dinheiro que pagamos em um plano fixo. Alguns números do Fable vêm da cobertura do lançamento citando a Anthropic, porque não encontramos o post de lançamento próprio da Anthropic para o Fable 5.1. Os preços batem com a página de preços da Anthropic.
Fontes
- Preços da API da Anthropic
- Anthropic: apresentando o Claude Opus 5.5
- Anthropic: modelos Claude Fable no seu plano
- Anthropic: usando o Claude Code com o seu plano Pro ou Max
- Claude Code: configuração de modelos
- Constellation Research: lançamento do Claude Fable 5.1
- NYU Shanghai RITS: corte no preço de leitura de cache do Fable 5.1
- Artificial Analysis: Claude Fable 5.1
- Snorkel: ranking do Terminal-Bench 4.0
Artigos relacionados
- Claude vs Codex em outubro de 2026
- Modelo de custo do Claude Fable 5.1
- Modelo de custo do Claude Opus 5.5
- Custo do Opus 5.5 por nível de esforço
- Limite semanal do Claude Max 20x vs 5x
Quer aplicar isto à sua plataforma? Traga as faturas dos fornecedores, os registos do gateway e os principais fluxos de trabalho; mapearemos os custos e as oportunidades de poupança. Marcar auditoria gratuita →