Bloccare la cascata di subagenti e la delega ricorsiva
Updated September 19, 2026 · first published September 19, 2026
La proliferazione a cascata dei subagenti si verifica quando un orchestratore suddivide un compito in sotto-attività parallele e concede ai worker la facoltà di istanziare ulteriori agenti specializzati. Senza limiti stringenti di concorrenza e profondità, un singolo prompt può innescare un'esplosione esponenziale: 1 supervisore genera 6 pianificatori, ciascuno dei quali avvia 4 agenti di ricerca. In pochi minuti vengono bruciati milioni di token con picchi di fatturazione inattesi.
Cos'è una cascata di fan-out di subagenti nell'IA autonoma?
È un'anomalia architetturale in cui un supervisore genera ricorsivamente agenti figli e nipoti senza tetti di spesa globali, moltiplicando i consumi in modo esponenziale su thread paralleli.
Quattro protezioni essenziali per la produzione
I team di piattaforma impediscono queste derive imponendo un tetto massimo di ricorsione a 2 livelli (orchestratore a worker), allocando un pool di token condiviso a livello di sessione radice, impostando circuit breaker per limitare la concorrenza a 3–5 agenti simultanei e propagando contesti di tracciamento OTLP.
Related
Want this applied to your own LLM spend? FinOps LLM runs a free audit of your AI costs and shows where the savings are. Book free audit →