Claude Fable 5.1 vs Opus 5.5: il reale moltiplicatore di prezzo dai nostri log di Claude Code
Aggiornato October 10, 2026 · pubblicato inizialmente October 10, 2026
Claude Fable 5.1 costa a listino $10 di input e $50 di output per milione di token. Opus 5.5 costa $4 e $20. È il 2,5x che citano tutti. Sul titolo è giusto, sulla fattura no: la lettura dalla cache, dove un agente spende la maggior parte dei suoi token, costa solo 1,25x. Abbiamo prezzato ogni turno di Fable e di Opus 5.5 in quattro settimane complete dei nostri log di Claude Code, per capire quanto vale davvero il premio.
- Prezzo sul nostro mix reale di token: 2,13x per i turni in stile Opus, 2,31x per i turni di Fable. Non 2,5x.
- Costo per turno, come eseguito davvero: un turno di Fable 5.1 è costato $0.284, un turno di Opus 5.5 $0.064. Sono 4,4x, perché Fable scrive circa 2,7x più output per turno con il suo effort predefinito high.
- I benchmark di programmazione favoriscono Opus 5.5: i numeri di Terminal-Bench 4.0 di Anthropic danno Opus 5.5 al 66,4% e Fable 5.1 al 55,8%. La run indipendente di Snorkel: 64,8% contro 57,9%, con la run di Fable che è costata 1,3x di più.
- I benchmark di ragionamento favoriscono Fable: Artificial Analysis dà a Fable 5.1 un 66 sul suo indice di intelligenza a effort max, il punteggio Claude più alto.
- Su un piano Max: Fable può prendere fino alla metà del tuo limite settimanale e lo consuma più in fretta. Noi l’abbiamo tenuto tra lo 0% e il 10% dell’uso di ogni settimana.
Cosa dice Anthropic
Sono dichiarazioni del vendor, riportate come pubblicate o come riferite dalla copertura del lancio. Le nostre misure vengono dopo.
| Dichiarazione | Fonte |
|---|---|
| Fable 5.1 costa a listino $10 di input, $50 di output, $0.25 di lettura in cache, $12.50 di scrittura a 5 minuti e $20 di scrittura a 1 ora per milione di token. | Pagina dei prezzi API |
| Opus 5.5 costa a listino $4 di input, $20 di output, $0.20 di lettura in cache, $5 di scrittura a 5 minuti e $8 di scrittura a 1 ora. | Pagina dei prezzi API |
| Fable 5.1 costa circa il 25% in meno di Fable 5 per carichi di lavoro tipici e fino a circa il 45% in meno per quelli agentici, soprattutto perché la lettura dalla cache è scesa da $1.00 a $0.25. | Copertura del lancio (Constellation Research, NYU Shanghai RITS) |
| Opus 5.5 va vicino a Fable 5.1 e, a effort predefinito, batte Opus 5 a effort max per circa un quinto del costo. | Post di lancio di Opus 5.5 |
| Terminal-Bench 4.0: Opus 5.5 al 66,4% con effort xhigh, Fable 5.1 al 55,8%. | Post di lancio di Opus 5.5 |
| Fable 5.1 ottiene il 60,9% su Humanity's Last Exam senza strumenti e il 65,0% con strumenti. L’effort high è il suo predefinito. | Copertura del lancio |
| Sui piani Max, i modelli Fable possono usare fino al 50% del tuo limite settimanale, hanno un limite settimanale proprio e consumano i limiti più in fretta degli altri modelli. Su Pro, Fable gira con i crediti di utilizzo a consumo. | Modelli Claude Fable sul tuo piano |
| Claude Code usa come predefinito Opus 5.5 sui piani a pagamento. Fable non è mai il predefinito; lo scegli con /model. | Documentazione sulla configurazione dei modelli di Claude Code |
Quello che Anthropic non pubblica: di quanto Fable svuota più in fretta un limite del piano. Le pagine del piano dicono "più veloce" e si fermano lì.
Perché il moltiplicatore reale è 2,1x-2,3x, non 2,5x
Un turno di agente in Claude Code rilegge l’intera conversazione dalla cache, poi scrive un po’ di output nuovo. Sui nostri 22.411 turni di Opus 5.5, il turno medio ha letto circa 94.000 token in cache e ha scritto circa 551 token di output. Le letture dalla cache costano per token 100 volte meno dell’output, ma ce ne sono 170 volte di più, quindi pesano davvero sulla fattura. Cinque tipi di token, cinque prezzi:
| Tipo di token, per milione | Opus 5.5 | Fable 5.1 | Moltiplicatore |
|---|---|---|---|
| Input | $4.00 | $10.00 | 2,5x |
| Output | $20.00 | $50.00 | 2,5x |
| Scrittura in cache, 5 minuti | $5.00 | $12.50 | 2,5x |
| Scrittura in cache, 1 ora | $8.00 | $20.00 | 2,5x |
| Lettura dalla cache | $0.20 | $0.25 | 1,25x |
Rifacendo il prezzo dei token esatti dei nostri turni di Opus 5.5 alle tariffe di Fable, la fattura passa da $1,436 a $3,061: 2,13x. Fatto al contrario per i nostri turni di Fable, si ottiene 2,31x; i turni di Fable pesano di più su output e scritture in cache da 1 ora, quindi una quota minore della loro fattura beneficia dello sconto sulla lettura dalla cache. Più il tuo agente è pesante in cache, più scendi sotto 2,5x. Un carico di sola chat senza cache sta al pieno 2,5x.
Per turno sono 4,4x, e il prezzo è solo metà di questo
| Per turno, nostri log | Opus 5.5 | Fable 5.1 |
|---|---|---|
| Turni | 22,411 | 486 |
| Token di output per turno | 551 | 1,461 |
| Token letti dalla cache per turno | circa 94,000 | circa 94,000 |
| Token di scrittura in cache da 1 ora per turno | 3,939 | 9,383 |
| Costo per turno al proprio prezzo di listino | $0.064 | $0.284 |
| Totale, quattro settimane | $1,436 | $138 |
Il contesto era identico, circa 94.000 token in cache per turno su entrambi. A cambiare è stato il comportamento. Fable ha scritto 2,7x più output per turno e 2,4x più cache nuova. È l’effort high, il predefinito di Fable, che ragiona di più a ogni passo. Il prezzo spiega circa 2,3x, il comportamento il resto, per 4,4x per turno.
Un’avvertenza onesta: abbiamo scelto Fable per i turni difficili. Parte dell’output in più è il compito, non il modello. Anche così, il divario per turno è il numero che vede la tua fattura.
Dati grezzi: fable-5-1-vs-opus-5-5-turns.csv.
Cosa compra la spesa extra
| Benchmark | Opus 5.5 | Fable 5.1 | Chi l’ha eseguito |
|---|---|---|---|
| Terminal-Bench 4.0 | 66,4% (xhigh) | 55,8% | Anthropic |
| Terminal-Bench 4.0, punteggio | 64,8% | 57,9% | Snorkel, indipendente |
| Terminal-Bench 4.0, costo della run | $4.7k, 8,0B token | $6.2k, 2,7B token | Snorkel, indipendente |
| Indice di intelligenza, costo per task | non sulla stessa pagina | 66 a effort max, $3.76; 65 a xhigh, $2.72 | Artificial Analysis |
Nella programmazione agentica, Opus 5.5 vince sia sul punteggio sia sul costo. La run di Snorkel mostra al contrario lo schema dei nostri log: Fable ha usato un terzo dei token ma è costato 1,3x di più, perché ciascuno dei suoi token costa di più. Sull’indice di ragionamento generale di Artificial Analysis, Fable 5.1 a effort max è il punteggio Claude più alto, davanti a Opus 5 a effort max (63, $2.34 per task). Artificial Analysis elenca Opus 5.5 a parte, tra 51 e 56 dal medium allo xhigh, per da $1.34 a $3.46 a task. Non li abbiamo visti sulla stessa pagina di confronto, quindi tratta quel divario come indicativo.
Cosa fa a una settimana di Claude Max
Usiamo ogni settimana l’intero limite settimanale di Claude Max 5x. Ai prezzi di listino di oggi (turni di Opus 5 e Sonnet 5 riprezzati a Opus 5.5 e Sonnet 5.5), le quattro settimane valevano $419, $761, $873 e $658. La quota di Fable era $39, $34, $0 e $65: 9,3%, 4,5%, 0% e 9,9% di ogni settimana. Anthropic permette a Fable di prendere fino al 50% di un limite settimanale e dice che consuma i limiti più in fretta, ma non di quanto. Se il piano misura vicino al prezzo di listino, ogni turno di Fable costa circa quattro turni di Opus 5.5 di quota. Se passi metà settimana su Fable, perdi circa il 40% dei turni che otterresti altrimenti.
Quando Fable 5.1 vale 2,5x
- Usa Opus 5.5 come predefinito per gli agenti di programmazione. Vince su Terminal-Bench di 7 a 11 punti e costa circa un quarto per turno. Claude Code lo usa già come predefinito.
- Passa a Fable per il ragionamento difficile in un colpo solo: una scelta di architettura, un’analisi complessa della causa radice, una revisione di specifiche. Pochi turni, posta alta, e guida sui benchmark di ragionamento.
- Sull’API, la cache riduce il divario. Un agente a contesto lungo con un alto tasso di cache hit paga circa 2,1x, non 2,5x. Un effort più basso lo riduce ancora.
- Su un piano Max, mettigli un tetto. Tieni Fable a circa il 10% della settimana, come abbiamo fatto noi. Oltre, comincia a mangiarsi i turni che ti servono per Opus.
Per il confronto completo dei piani con Codex, vedi Claude vs Codex a ottobre 2026. Per la matematica dei cache hit dietro il prezzo di Fable, vedi il modello di costo di Fable 5.1.
Cosa non mostra
Sono i log di un unico utente intensivo. Fable ha girato 486 turni contro 22.411 di Opus 5.5, e abbiamo scelto Fable per i turni più difficili, quindi il suo costo per turno è spinto verso l’alto. Gli importi in dollari sono valore a listino API, non denaro pagato su un piano a tariffa fissa. Alcuni valori di Fable vengono dalla copertura del lancio che cita Anthropic, perché non abbiamo trovato il post di lancio di Fable 5.1 di Anthropic. I prezzi coincidono con la pagina prezzi di Anthropic.
Fonti
- Prezzi API di Anthropic
- Anthropic: presentazione di Claude Opus 5.5
- Anthropic: modelli Claude Fable sul tuo piano
- Anthropic: usare Claude Code con il tuo piano Pro o Max
- Claude Code: configurazione dei modelli
- Constellation Research: lancio di Claude Fable 5.1
- NYU Shanghai RITS: taglio del prezzo di lettura dalla cache di Fable 5.1
- Artificial Analysis: Claude Fable 5.1
- Snorkel: classifica Terminal-Bench 4.0
Correlati
- Claude vs Codex a ottobre 2026
- Modello di costo di Claude Fable 5.1
- Modello di costo di Claude Opus 5.5
- Costo dei livelli di effort di Opus 5.5
- Claude Max 20x vs 5x: limite settimanale
Vuoi applicarlo al tuo stack? Porta le fatture dei provider, i log del gateway e i flussi di lavoro principali: mapperemo i costi e i possibili risparmi. Prenota un audit gratuito →