Zatrzymanie rozrostu subagentów i rekurencyjnej delegacji
Zaktualizowano September 19, 2026 · pierwsza publikacja September 19, 2026
Kaskady rozrostu subagentów powstają, gdy autonomiczny orkiestrator rozbija zadanie wysokiego poziomu na równoległe podzadania i pozwala agentom roboczym tworzyć kolejnych wyspecjalizowanych pracowników. Bez twardych limitów współbieżności i głębokości jeden niejednoznaczny prompt użytkownika może wywołać wykładniczą eksplozję: 1 główny supervisor tworzy 6 planistów dziedzinowych, każdy uruchamia 4 agentów badawczych, które wywołują kolejnych podwykonawców. W produkcyjnych architekturach nieograniczona rekurencyjna delegacja regularnie spala od 2,000,000 do 8,000,000 tokenów w ciągu 5 minut, co daje nieoczekiwane skoki w rachunku API rzędu 15–80 $ za pojedynczą transakcję.
Matematyka rekurencyjnej delegacji agentów
W standardowym, drzewiastym układzie agentów delegacja rozrasta się zgodnie ze współczynnikiem rozgałęzienia B podniesionym do głębokości wykonania D. Jeśli orkiestrator rozgałęzia się przy B = 4 i pozwala subagentom rekurować do głębokości D = 3, system uruchamia 64 niezależne pętle agentów. Każdy agent liść utrzymuje własny kontekst rozmowy, wykonuje iteracyjne wywołania narzędzi i przekazuje wyniki pośrednie w górę hierarchii. Ponieważ agenci nadrzędni agregują i streszczają wyjścia dzieci, akumulacja kontekstu narasta kwadratowo w całym drzewie wykonania.
Czym jest kaskada rozrostu subagentów w autonomicznym AI?
Kaskada rozrostu subagentów to tryb awarii, w którym agent orkiestrujący rekurencyjnie tworzy agentów potomnych i wnuków bez globalnych ograniczeń budżetowych, mnożąc zużycie tokenów wykładniczo w równoległych wątkach wykonania.
Cztery produkcyjne guardraile dla flot wieloagentowych
Zespoły platformowe, które prowadzą korporacyjne systemy agentowe, zapobiegają niekontrolowanym kaskadom, egzekwując ścisłe granice działania w czasie wykonania:
- Maksymalna głębokość rekurencji (Depth Caps): Wymuś sztywny sufit hierarchii wykonania. W 95% zastosowań korporacyjnych limit głębokości
max_depth: 2(Root Supervisor → Worker Agent) w pełni rozwiązuje zadanie. Zakaz tworzenia subagentów trzeciego rzędu przez agentów roboczych, chyba że polityka stanowi inaczej. - Wspólne pule tokenów wątku (Shared Thread Token Pools): Nie przydzielaj subagentom niezależnych budżetów. Przydziel wspólny limit tokenów (np. 250,000 tokenów łącznie) do kontekstu wątku głównego. Przekazuj pozostały saldo przez nagłówki kontekstu śledzenia. Gdy subagenty zużywają tokeny, zmniejszaj globalną pulę; gdy pula dojdzie do zera, wszystkie równoległe gałęzie natychmiast się kończą.
- Wyłączniki współbieżności (Concurrency Circuit Breakers): Ogranicz liczbę aktywnych równoległych instancji subagentów do 3–5 procesów jednocześnie. Jeśli supervisor próbuje utworzyć więcej współbieżnych pracowników, niż pozwala pojemność kolejki, ustaw zadania w kolejce sekwencyjnie albo odrzuć podział.
- Rozproszone śledzenie i propagacja kosztów OTLP: Wstrzykuj identyfikatory śledzenia OpenTelemetry i nagłówki baggage do wszystkich magistrali komunikacji między agentami. Gdy OpenLIT lub ClickHouse agregują wydatki, każdy span potomny musi sumować się do identyfikatora sesji nadrzędnej, co daje natychmiastową widoczność anomalii kosztów na poziomie gałęzi.
Jak limity współbieżności zapobiegają wyczerpaniu tokenów przez wielu agentów?
Limity współbieżności ograniczają liczbę jednocześnie wykonywanych pętli pracowników, zapobiegając zalewaniu API równoległymi wywołaniami i pozwalając wyłącznikom przerwać nieprawidłowo działające pętle agentów, zanim budżety tokenów się wyczerpią.
Jaka jest zalecana głębokość rekurencji przy delegacji agentów?
Zalecana głębokość rekurencji to 2 poziomy (Root Orchestrator do wyspecjalizowanego pracownika). Głębsze hierarchie dają malejące zyski z rozumowania, a jednocześnie gwałtownie zwiększają narzut kontekstu i wzmacnianie błędów.
Powiązane
Chcesz zastosować to w swoim stosie? Przynieś faktury dostawców, logi bramy i najważniejsze przepływy pracy; wskażemy czynniki kosztów i ścieżkę oszczędności. Umów bezpłatny audyt →