Modello di costo di Claude Opus 5.5

Updated September 22, 2026 · first published September 22, 2026

Anthropic ha rilasciato Claude Opus 5.5 (claude-opus-5-5) il 22 settembre 2026. Il prezzo annunciato è $4 per milione di token di input e $20 per milione di token di output, rispetto ai $5 e $25 di Opus 5. Si tratta di un taglio del 20%. Per la maggior parte dei carichi di lavoro in produzione, il taglio effettivo è maggiore, perché il tasso che si è mosso di più è quello che il titolo omette.

Le tariffe che contano

Tipo di tokenOpus 5.5Opus 5Fable 5.1
Input (non cachato)$4.00 / MTok$5.00 / MTok$10.00 / MTok
Output$20.00 / MTok$25.00 / MTok$50.00 / MTok
Scrittura della cache (5 min)$5.00 / MTok$6.25 / MTok$12.50 / MTok
Lettura della cache$0.20 / MTok$0.50 / MTok$0.25 / MTok
Modalità veloce (input / output)$8 / $40

Ogni riga è il 20% più bassa tranne la lettura della cache, che è il 60% più economica. A $0.20 è ora più economico dei $0.25 di Fable 5.1. Questo inverte l'unica riga in cui Fable era solito vincere. Nel nostro modello di costo di Fable 5.1, un carico di lavoro molto cachato potrebbe risultare più economico su Fable che su Opus 5. Rispetto a Opus 5.5, questo non accade più. Fable costa di più su ogni tipo di token.

Perché un'attività tipica costa circa il 40% in meno

L'affermazione di Anthropic è una riduzione del 40% dei costi per un lavoro tipico, non del 20%. L'extra proviene dall'efficienza del token. Anthropic afferma che Opus 5.5 raggiunge lo stesso risultato con circa il 20% meno token di input e output e scrive output circa il 40% meno verboso. Un tasso più basso per meno token si compone: 0.8 × 0.8 = 0.64, che è approssimativamente uno sconto del 36–40% a seconda del mix.

Ecco un passo dell'agente: 200.000 token di input, il 90% servito dalla cache, e 20.000 token di output.

RigaOpus 5Opus 5.5 (stessi token)Fable 5.1
20K input non cachato$0.100$0.080$0.200
180K input cachato$0.090$0.036$0.045
20K output$0.500$0.400$1.000
Totale$0.690$0.516$1.245

Su token identici, Opus 5.5 è il 25% più economico di Opus 5, non il 20%, a causa dello sconto della cache. Se la riduzione del 20% dei token si mantiene per il vostro carico di lavoro, il passo scende a circa $0.41, che è il 40% sotto Opus 5 e un terzo del costo di Fable. L'output rappresenta ancora circa l'80% della fattura in questo esempio. È qui che la riduzione della verbosità ripaga.

Costo per attività rispetto a GPT-6 Sol, GPT-6 Astra e Fable 5.1

Prezzi di listino per milione di token e lo stesso passo d'agente visto sopra (200K di input, 90% in cache, 20K di output) calcolato su ogni modello.

ModelloInput $/MTokOutput $/MTokLettura cache $/MTokStesso passo d'agente
GPT-6 Sol$2.00$10.00$0.20$0.276
Claude Opus 5.5$4.00$20.00$0.20$0.516
Claude Opus 5$5.00$25.00$0.50$0.690
Claude Fable 5.1$10.00$50.00$0.25$1.245
GPT-6 Astra$10.00$50.00$1.00$1.380

Costo per attività misurato sull'Artificial Analysis Intelligence Index v4.3.2, consultato il 22 settembre 2026, ordinato per punteggio. GPT-6 Sol è il modo più economico per raggiungere qualsiasi punteggio fino a 47,5. Sopra, Opus 5.5 è il più economico a ogni livello: Opus 5.5 high ottiene 53,6 per 1,82 $, mentre GPT-6 Astra max ottiene 52,7 per 3,26 $ e Fable 5.1 max 53,4 per 7,63 $.

ModelloIntelligence IndexCosto per attivitàToken di output per attività
GPT-6 Sol · medium39.8$0.256,500
GPT-6 Sol · xhigh44.1$0.5316,000
GPT-6 Astra · low45.8$0.824,400
GPT-6 Sol · max47.5$1.0631,200
Claude Opus 5 · high48.1$3.6146,200
Claude Opus 5 · max50.8$5.8672,500
Claude Opus 5.5 · medium51.2$1.3425,700
Claude Fable 5.1 · high51.2$3.9138,100
GPT-6 Astra · max52.7$3.2627,200
Claude Fable 5.1 · max53.4$7.6378,100
Claude Opus 5.5 · high53.6$1.8235,600
Claude Opus 5.5 · max57.6$5.98119,200

Ogni impostazione di GPT-6 Astra sopra low, ogni impostazione di Opus 5 e ogni impostazione di Fable 5.1 costa più di un'impostazione di Sol o Opus 5.5 con punteggio uguale o superiore. Il costo per attività dipende dal mix di attività del benchmark. Riproduci il tuo traffico prima di cambiare modello.

È abbastanza buono per sostituire Fable?

Anthropic posiziona Opus 5.5 come corrispondente a Fable 5.1 sulla maggior parte dei compiti. I numeri pubblicati lo supportano per il lavoro di codifica e agentivo:

Artificial Analysis lo ha classificato al primo posto nel suo Indice di Intelligenza nel giorno del lancio. Anthropic dice anche che a sforzo predefinito (medio) supera GPT-6 Astra a sforzo massimo sul lavoro di conoscenza per circa un quinto del costo per compito. Questo è un confronto tra fornitori, quindi trattalo come un'ipotesi da testare. La matematica dei costi sopra è la parte che puoi verificare da solo.

La modalità veloce costa 2×

La modalità veloce costa $8 in input e $40 in output, esattamente il doppio della tariffa standard, per fino a 2.5× la velocità. Il modello standard è anche circa il 30% più veloce di Opus 5. Utilizza la modalità veloce per percorsi interattivi legati alla latenza in cui un utente sta aspettando. Mantienilo spento per lavori batch, agenti in background e valutazioni. Quando la modalità veloce è abilitata per impostazione predefinita, il costo unitario raddoppia e il dashboard non mostra nulla di insolito fino all'arrivo della fattura.

Cosa fare questa settimana

  1. Blocca l'ID del modello. Indirizza la produzione a claude-opus-5-5 esplicitamente e registra l'ID su ogni richiesta, così il costo per richiesta può essere diviso per modello dopo la migrazione.
  2. Ri-calibra sul tuo traffico. Ripeti un campione di richieste reali su entrambi i modelli e confronta i token per attività completata, non per chiamata. L'affermazione di efficienza del 20% dei token è la parte più probabile di variare per carico di lavoro.
  3. Ri-controlla le impostazioni dello sforzo. Se un carico di lavoro si è spostato su Fable o su sforzo massimo per la qualità, prova Opus 5.5 prima a livello medio. Questa è l'impostazione rispetto alla quale Anthropic fa benchmark.
  4. Ri-esegui la decisione di routing di Fable. Qualsiasi route che ha inviato traffico pesante in cache a Fable per ottenere la lettura della cache più economica dovrebbe essere rivalutata. Questo vantaggio di costo è sparito.
  5. Monitora il rapporto di hit della cache. A $0.20 contro $4.00, un miss della cache ora costa 20× un hit. Una modifica del modello di prompt che rompe il prefisso costa più di quanto farebbe su Opus 5.

Anthropic dice che Sonnet 5.5 e Haiku 5.5 seguiranno nelle prossime settimane. Conserva l'apparecchio di replay dal passo 2 così ogni rilascio può essere ri-basato in un pomeriggio.

Related


Want this applied to your own LLM spend? FinOps LLM runs a free audit of your AI costs and shows where the savings are. Book free audit →

Back to research