Modello di costo di Claude Opus 5.5
Updated September 22, 2026 · first published September 22, 2026
Anthropic ha rilasciato Claude Opus 5.5 (claude-opus-5-5) il 22 settembre 2026. Il prezzo annunciato è $4 per milione di token di input e $20 per milione di token di output, rispetto ai $5 e $25 di Opus 5. Si tratta di un taglio del 20%. Per la maggior parte dei carichi di lavoro in produzione, il taglio effettivo è maggiore, perché il tasso che si è mosso di più è quello che il titolo omette.
Le tariffe che contano
| Tipo di token | Opus 5.5 | Opus 5 | Fable 5.1 |
|---|---|---|---|
| Input (non cachato) | $4.00 / MTok | $5.00 / MTok | $10.00 / MTok |
| Output | $20.00 / MTok | $25.00 / MTok | $50.00 / MTok |
| Scrittura della cache (5 min) | $5.00 / MTok | $6.25 / MTok | $12.50 / MTok |
| Lettura della cache | $0.20 / MTok | $0.50 / MTok | $0.25 / MTok |
| Modalità veloce (input / output) | $8 / $40 | — | — |
Ogni riga è il 20% più bassa tranne la lettura della cache, che è il 60% più economica. A $0.20 è ora più economico dei $0.25 di Fable 5.1. Questo inverte l'unica riga in cui Fable era solito vincere. Nel nostro modello di costo di Fable 5.1, un carico di lavoro molto cachato potrebbe risultare più economico su Fable che su Opus 5. Rispetto a Opus 5.5, questo non accade più. Fable costa di più su ogni tipo di token.
Perché un'attività tipica costa circa il 40% in meno
L'affermazione di Anthropic è una riduzione del 40% dei costi per un lavoro tipico, non del 20%. L'extra proviene dall'efficienza del token. Anthropic afferma che Opus 5.5 raggiunge lo stesso risultato con circa il 20% meno token di input e output e scrive output circa il 40% meno verboso. Un tasso più basso per meno token si compone: 0.8 × 0.8 = 0.64, che è approssimativamente uno sconto del 36–40% a seconda del mix.
Ecco un passo dell'agente: 200.000 token di input, il 90% servito dalla cache, e 20.000 token di output.
| Riga | Opus 5 | Opus 5.5 (stessi token) | Fable 5.1 |
|---|---|---|---|
| 20K input non cachato | $0.100 | $0.080 | $0.200 |
| 180K input cachato | $0.090 | $0.036 | $0.045 |
| 20K output | $0.500 | $0.400 | $1.000 |
| Totale | $0.690 | $0.516 | $1.245 |
Su token identici, Opus 5.5 è il 25% più economico di Opus 5, non il 20%, a causa dello sconto della cache. Se la riduzione del 20% dei token si mantiene per il vostro carico di lavoro, il passo scende a circa $0.41, che è il 40% sotto Opus 5 e un terzo del costo di Fable. L'output rappresenta ancora circa l'80% della fattura in questo esempio. È qui che la riduzione della verbosità ripaga.
Costo per attività rispetto a GPT-6 Sol, GPT-6 Astra e Fable 5.1
Prezzi di listino per milione di token e lo stesso passo d'agente visto sopra (200K di input, 90% in cache, 20K di output) calcolato su ogni modello.
| Modello | Input $/MTok | Output $/MTok | Lettura cache $/MTok | Stesso passo d'agente |
|---|---|---|---|---|
| GPT-6 Sol | $2.00 | $10.00 | $0.20 | $0.276 |
| Claude Opus 5.5 | $4.00 | $20.00 | $0.20 | $0.516 |
| Claude Opus 5 | $5.00 | $25.00 | $0.50 | $0.690 |
| Claude Fable 5.1 | $10.00 | $50.00 | $0.25 | $1.245 |
| GPT-6 Astra | $10.00 | $50.00 | $1.00 | $1.380 |
Costo per attività misurato sull'Artificial Analysis Intelligence Index v4.3.2, consultato il 22 settembre 2026, ordinato per punteggio. GPT-6 Sol è il modo più economico per raggiungere qualsiasi punteggio fino a 47,5. Sopra, Opus 5.5 è il più economico a ogni livello: Opus 5.5 high ottiene 53,6 per 1,82 $, mentre GPT-6 Astra max ottiene 52,7 per 3,26 $ e Fable 5.1 max 53,4 per 7,63 $.
| Modello | Intelligence Index | Costo per attività | Token di output per attività |
|---|---|---|---|
| GPT-6 Sol · medium | 39.8 | $0.25 | 6,500 |
| GPT-6 Sol · xhigh | 44.1 | $0.53 | 16,000 |
| GPT-6 Astra · low | 45.8 | $0.82 | 4,400 |
| GPT-6 Sol · max | 47.5 | $1.06 | 31,200 |
| Claude Opus 5 · high | 48.1 | $3.61 | 46,200 |
| Claude Opus 5 · max | 50.8 | $5.86 | 72,500 |
| Claude Opus 5.5 · medium | 51.2 | $1.34 | 25,700 |
| Claude Fable 5.1 · high | 51.2 | $3.91 | 38,100 |
| GPT-6 Astra · max | 52.7 | $3.26 | 27,200 |
| Claude Fable 5.1 · max | 53.4 | $7.63 | 78,100 |
| Claude Opus 5.5 · high | 53.6 | $1.82 | 35,600 |
| Claude Opus 5.5 · max | 57.6 | $5.98 | 119,200 |
Ogni impostazione di GPT-6 Astra sopra low, ogni impostazione di Opus 5 e ogni impostazione di Fable 5.1 costa più di un'impostazione di Sol o Opus 5.5 con punteggio uguale o superiore. Il costo per attività dipende dal mix di attività del benchmark. Riproduci il tuo traffico prima di cambiare modello.
È abbastanza buono per sostituire Fable?
Anthropic posiziona Opus 5.5 come corrispondente a Fable 5.1 sulla maggior parte dei compiti. I numeri pubblicati lo supportano per il lavoro di codifica e agentivo:
- Terminal-Bench 4.0: 66.4%, contro 52.3% per Opus 5 e 55.8% per Fable 5.1.
- FrontierCode v1.1: 54.4%, contro 48.0% per Opus 5 e 50.3% per Fable 5.1.
- CursorBench 4.0: 57.8%, contro 46.6% per Opus 5.
- GDPval-AA v2.1: 1846 Elo, contro 1708 per Opus 5.
Artificial Analysis lo ha classificato al primo posto nel suo Indice di Intelligenza nel giorno del lancio. Anthropic dice anche che a sforzo predefinito (medio) supera GPT-6 Astra a sforzo massimo sul lavoro di conoscenza per circa un quinto del costo per compito. Questo è un confronto tra fornitori, quindi trattalo come un'ipotesi da testare. La matematica dei costi sopra è la parte che puoi verificare da solo.
La modalità veloce costa 2×
La modalità veloce costa $8 in input e $40 in output, esattamente il doppio della tariffa standard, per fino a 2.5× la velocità. Il modello standard è anche circa il 30% più veloce di Opus 5. Utilizza la modalità veloce per percorsi interattivi legati alla latenza in cui un utente sta aspettando. Mantienilo spento per lavori batch, agenti in background e valutazioni. Quando la modalità veloce è abilitata per impostazione predefinita, il costo unitario raddoppia e il dashboard non mostra nulla di insolito fino all'arrivo della fattura.
Cosa fare questa settimana
- Blocca l'ID del modello. Indirizza la produzione a
claude-opus-5-5esplicitamente e registra l'ID su ogni richiesta, così il costo per richiesta può essere diviso per modello dopo la migrazione. - Ri-calibra sul tuo traffico. Ripeti un campione di richieste reali su entrambi i modelli e confronta i token per attività completata, non per chiamata. L'affermazione di efficienza del 20% dei token è la parte più probabile di variare per carico di lavoro.
- Ri-controlla le impostazioni dello sforzo. Se un carico di lavoro si è spostato su Fable o su sforzo massimo per la qualità, prova Opus 5.5 prima a livello medio. Questa è l'impostazione rispetto alla quale Anthropic fa benchmark.
- Ri-esegui la decisione di routing di Fable. Qualsiasi route che ha inviato traffico pesante in cache a Fable per ottenere la lettura della cache più economica dovrebbe essere rivalutata. Questo vantaggio di costo è sparito.
- Monitora il rapporto di hit della cache. A $0.20 contro $4.00, un miss della cache ora costa 20× un hit. Una modifica del modello di prompt che rompe il prefisso costa più di quanto farebbe su Opus 5.
Anthropic dice che Sonnet 5.5 e Haiku 5.5 seguiranno nelle prossime settimane. Conserva l'apparecchio di replay dal passo 2 così ogni rilascio può essere ri-basato in un pomeriggio.
Related
- Modello di costo di Claude Fable 5.1
- Economia della memorizzazione nella cache del prompt
- I livelli di sforzo di Opus 5.5 sono il prezzo reale
- Economia della modalità veloce Opus 5.5
Want this applied to your own LLM spend? FinOps LLM runs a free audit of your AI costs and shows where the savings are. Book free audit →