Quick answer: Quando la spesa per gli LLM subisce un picco improvviso, non iniziate modificando il modello. Conservate innanzitutto le prove, verificate i segnali di fatturazione e isolate se l'anomalia dipende da...

Runbook di produzione per picchi di costo LLM

Updated August 27, 2026 · first published August 27, 2026

Quando la spesa per gli LLM subisce un picco improvviso, non iniziate modificando il modello. Conservate innanzitutto le prove, verificate i segnali di fatturazione e isolate se l'anomalia dipende da volume, tariffe, mix di modelli o efficienza.

Primi 15 minuti: confermare e preservare

Salvate fatture, telemetria del gateway, traffico corrente, mix di modelli e log dei recenti deployment prima di apportare modifiche.

Primi 30 minuti: contenimento sicuro

Applicate il controllo più circoscritto possibile: mettete in pausa un flusso anomalo, limitate un agente, instradate carichi su batch o disattivate una feature appena rilasciata. Assegnate a ogni misura un responsabile e una data di scadenza.

Identificare la causa radice

Verificate volumi, composizione dei token, lunghezza del contesto, chiamate a tool e tariffe dei provider confrontando il costo per task riuscito con la baseline.

Related


Want this applied to your own LLM spend? FinOps LLM runs a free audit of your AI costs and shows where the savings are. Book free audit →

Back to research