Economia di Opus 5.5 fast mode
Updated September 22, 2026 · first published September 22, 2026
Claude Opus 5.5 ha due listini. Standard è $4 per milione di token in ingresso e $20 per milione di uscita. Fast mode è $8 e $40, esattamente il doppio, per fino a 2,5× la velocità di uscita. Il modello è identico. Il denaro aggiuntivo acquista tempo e basta, quindi l'unica domanda è il tempo di chi.
Cosa acquista il premio
Prendi uno step che produce 5.000 token di uscita. Ai tariffari standard il costo è $0,10. In fast mode costa $0,20. Se lo step impiega 60 secondi a velocità standard, un speedup di 2,5× lo riduce a circa 24 secondi. Paghi $0,10 in più per risparmiare 36 secondi.
Equivale a circa $10 per ogni ora di attesa eliminata. La lunghezza dello step non cambia il rapporto, perché il costo aggiuntivo e il tempo risparmiato crescono con i token di uscita. Dipende dalla tua velocità in modalità standard: questo esempio assume circa 83 token di uscita al secondo. Anche l'ingresso raddoppia, quindi gli step ricchi di prefisso pagano un po' più per secondo risparmiato.
Quando è conveniente
- Uno sviluppatore che attende un agente di coding interattivo. A $10 per ora di attesa eliminata, fast mode costa molto meno del tempo di chiunque sia pagato.
- Una risposta rivolte al cliente dove la latenza influisce sulla conversione. Valuta il miglioramento di velocità contro l'abbandono, non contro la fattura dei token.
- Un incidente, dove ogni minuto ha un costo.
Quando è puro spreco
- Agenti in background, lavori notturni e pipeline batch. Nessuno aspetta, quindi la spesa aggiuntiva non compra nulla.
- Evals e replay. Sono esattamente i carichi di lavoro che moltiplicano i conteggi di token ed eseguono secondo una pianificazione.
- Subagenti che eseguono in parallelo. Il tempo wall-clock è impostato dal ramo più lento e dall'orchestratore, non da ogni chiamata.
Opus 5.5 standard è già circa il 30% più veloce di Opus 5, secondo Anthropic. Alcuni lamenti sulla latenza che avrebbero giustificato fast mode su Opus 5 potrebbero essere risolti solo dall'upgrade. Misura la velocità standard prima di pagare per più.
Controlli da implementare
- Rendi fast mode una decisione esplicita, per route. Non dovrebbe mai essere un default globale o un flag che un ingegnere ha attivato una volta e dimenticato.
- Contrassegna la spesa per modalità. Una richiesta di fast mode al doppio del prezzo unitario appare come una richiesta normale su un dashboard che raggruppa solo per modello.
- Avvisa sulla quota di fast mode dei token di uscita. Se aumenta su route dove nessun utente aspetta, qualcosa è stato attivato che non dovrebbe essere.
- Bilancia sforzo e velocità insieme. Lo sforzo massimo moltiplica il conteggio dei token, e fast mode raddoppia il prezzo di ogni token. È il modo più costoso di eseguire il modello.
Related
- Modello di costo Claude Opus 5.5
- I livelli di sforzo di Opus 5.5 sono il vero prezzo
- Limiti di fan-out e concorrenza dei subagenti
Want this applied to your own LLM spend? FinOps LLM runs a free audit of your AI costs and shows where the savings are. Book free audit →