Economia di Opus 5.5 fast mode

Updated September 22, 2026 · first published September 22, 2026

Claude Opus 5.5 ha due listini. Standard è $4 per milione di token in ingresso e $20 per milione di uscita. Fast mode è $8 e $40, esattamente il doppio, per fino a 2,5× la velocità di uscita. Il modello è identico. Il denaro aggiuntivo acquista tempo e basta, quindi l'unica domanda è il tempo di chi.

Cosa acquista il premio

Prendi uno step che produce 5.000 token di uscita. Ai tariffari standard il costo è $0,10. In fast mode costa $0,20. Se lo step impiega 60 secondi a velocità standard, un speedup di 2,5× lo riduce a circa 24 secondi. Paghi $0,10 in più per risparmiare 36 secondi.

Equivale a circa $10 per ogni ora di attesa eliminata. La lunghezza dello step non cambia il rapporto, perché il costo aggiuntivo e il tempo risparmiato crescono con i token di uscita. Dipende dalla tua velocità in modalità standard: questo esempio assume circa 83 token di uscita al secondo. Anche l'ingresso raddoppia, quindi gli step ricchi di prefisso pagano un po' più per secondo risparmiato.

Quando è conveniente

Quando è puro spreco

Opus 5.5 standard è già circa il 30% più veloce di Opus 5, secondo Anthropic. Alcuni lamenti sulla latenza che avrebbero giustificato fast mode su Opus 5 potrebbero essere risolti solo dall'upgrade. Misura la velocità standard prima di pagare per più.

Controlli da implementare

  1. Rendi fast mode una decisione esplicita, per route. Non dovrebbe mai essere un default globale o un flag che un ingegnere ha attivato una volta e dimenticato.
  2. Contrassegna la spesa per modalità. Una richiesta di fast mode al doppio del prezzo unitario appare come una richiesta normale su un dashboard che raggruppa solo per modello.
  3. Avvisa sulla quota di fast mode dei token di uscita. Se aumenta su route dove nessun utente aspetta, qualcosa è stato attivato che non dovrebbe essere.
  4. Bilancia sforzo e velocità insieme. Lo sforzo massimo moltiplica il conteggio dei token, e fast mode raddoppia il prezzo di ogni token. È il modo più costoso di eseguire il modello.

Related


Want this applied to your own LLM spend? FinOps LLM runs a free audit of your AI costs and shows where the savings are. Book free audit →

Back to research