Runbook di produzione per picchi di costo LLM
Updated August 27, 2026 · first published August 27, 2026
Quando la spesa per gli LLM subisce un picco improvviso, non iniziate modificando il modello. Conservate innanzitutto le prove, verificate i segnali di fatturazione e isolate se l'anomalia dipende da volume, tariffe, mix di modelli o efficienza.
Primi 15 minuti: confermare e preservare
Salvate fatture, telemetria del gateway, traffico corrente, mix di modelli e log dei recenti deployment prima di apportare modifiche.
Primi 30 minuti: contenimento sicuro
Applicate il controllo più circoscritto possibile: mettete in pausa un flusso anomalo, limitate un agente, instradate carichi su batch o disattivate una feature appena rilasciata. Assegnate a ogni misura un responsabile e una data di scadenza.
Identificare la causa radice
Verificate volumi, composizione dei token, lunghezza del contesto, chiamate a tool e tariffe dei provider confrontando il costo per task riuscito con la baseline.
Related
Want this applied to your own LLM spend? FinOps LLM runs a free audit of your AI costs and shows where the savings are. Book free audit →