Claude Sonnet 5.5: la guida al model routing attento ai costi
Aggiornato September 28, 2026 · pubblicato inizialmente September 28, 2026
Claude Sonnet 5.5 è stato lanciato il 28 settembre 2026 alle tariffe API di Sonnet 5: $2 per milione di token di input e $10 per milione di token di output. Anthropic lo posiziona per il lavoro quotidiano ben circoscritto, correzione di bug, coding e documenti curati, mentre Opus 5.5 è pensato per attività più complesse che richiedono giudizio attento. Per i team, la domanda utile non è quale modello vinca un benchmark, ma quale rispetti gli obiettivi di qualità e latenza di ciascun task al costo più basso per risultato accettato.
Anthropic dichiara che Sonnet 5.5 è più veloce di oltre il 30% rispetto a Sonnet 5 e può costare fino al 30% in meno per task. Sono dichiarazioni di lancio. Usatele per scegliere cosa valutare, non come riduzioni di budget automatiche.
Cosa ha annunciato Anthropic
- Sonnet 5.5 mantiene i prezzi di listino API di Sonnet 5: $2/MTok di input, $10/MTok di output, $2.50/MTok per le scritture di cache a 5 minuti, $4/MTok per le scritture a 1 ora e $0.20/MTok per le letture di cache.
- Anthropic riporta una generazione dell'output più veloce di oltre il 30% rispetto a Sonnet 5 e un costo per task inferiore fino al 30% per la maggior parte dei lavori, grazie all'efficienza nell'uso dei token.
- L'azienda descrive Sonnet come il più forte nei task quotidiani ben circoscritti; Opus è progettato per i task complessi che richiedono giudizio attento.
- Anthropic afferma che Haiku 5.5 è atteso nelle prossime settimane. Non faceva parte del lancio di oggi.
Consultate l'annuncio di lancio di Anthropic per le descrizioni complete dei benchmark e le avvertenze.
Una policy di routing da testare
| Carico di lavoro | Candidato di partenza | Cosa misurare |
|---|---|---|
| Modifiche di coding di routine, correzione di bug, editing di documenti | Sonnet 5.5 | Tasso di modifiche accettate, tentativi ripetuti, token di output, tempo trascorso |
| Lavoro ambiguo e a lungo orizzonte, con forti requisiti di giudizio | Confrontare Sonnet 5.5 con Opus 5.5 | Qualità a ogni livello di effort, frequenza di escalation, costo end-to-end |
| Classificazione o estrazione semplice ad alto volume | Confrontare Sonnet con i modelli a costo inferiore già presenti nel vostro stack | Soglia di qualità, costo per record valido, gestione delle eccezioni |
| Lavoro interattivo sensibile alla latenza | Testare Sonnet 5.5 al livello di effort che raggiunge la soglia di qualità | Latenza di coda, tasso di completamento e costo per task completato |
Questa è una matrice di test, non l'affermazione che un modello sia sempre la scelta giusta per una categoria di carico. Forma del prompt, lunghezza del contesto, ambiente di tool e criteri di valutazione possono cambiare il risultato.
Perché il confronto sui prezzi di listino è incompleto
Il prezzo per token di Sonnet 5.5 non è sceso al lancio. Il risparmio potenziale sta in quanti token e passaggi dell'agente servono per completare un task. Un modello che genera una risposta più breve ma innesca più chiamate a tool può costare di più nel complesso; un modello che finisce prima ma usa gli stessi token può migliorare la reattività senza cambiare la fattura dei token.
Per un agente, calcolate il totale di un task come token di input × tariffa di input + token di output × tariffa di output + scritture/letture di cache + eventuali tool o infrastruttura fatturati a parte. Confrontate il totale solo dopo aver verificato che il task superi gli stessi controlli di accettazione.
Misurate la migrazione prima di cambiare il budget
- Scegliete qualche centinaio di task rappresentativi, inclusi fallimenti e casi limite.
- Eseguite Sonnet 5 e 5.5 con gli stessi tool, prompt, limiti di contesto e livelli di effort, ove possibile.
- Registrate addebiti di token, tentativi ripetuti, chiamate a tool, tempo di completamento e accettazione umana.
- Confrontate il costo per task accettato e riportate i risultati per famiglia di task, non solo come media globale.
- Fate un canary dei carichi che superano le vostre soglie. Mantenete una via di ritorno al modello precedente mentre monitorate qualità e spesa.
Partite con previsioni a risparmio zero. Sostituite questa ipotesi con delta misurati man mano che la valutazione produce evidenze. Per tariffe API e prezzi della cache, usate la documentazione sui prezzi di Anthropic.
FAQ
Sonnet 5.5 costa meno di Sonnet 5?
Le tariffe per token di listino sono le stesse. Anthropic dice che può costare fino al 30% in meno per task perché usa meno token, ma i risultati dipendono dal carico di lavoro.
Sonnet 5.5 sostituisce Opus 5.5?
No. Anthropic presenta i modelli per profili di task diversi. Valutate entrambi dove difficoltà del task, costo dell'errore o requisiti di qualità giustificano il confronto.
È disponibile su AWS?
AWS ha annunciato la disponibilità il 28 settembre tramite Amazon Bedrock e Claude Platform on AWS. Verificate regione, accesso al modello e dettagli di prezzo correnti di ciascun servizio prima di pianificare il rilascio.
Fonti e letture correlate
- Anthropic: Introducing Claude Sonnet 5.5
- AWS: Claude Sonnet 5.5 now available on AWS
- Prezzi di Sonnet 5.5 e modello di costo per task
- Modello di costo di Claude Opus 5.5
Correlati
Vuoi applicarlo al tuo stack? Porta le fatture dei provider, i log del gateway e i flussi di lavoro principali: mapperemo i costi e i possibili risparmi. Prenota un audit gratuito →