Przejdź do treści

Model kosztów agenta always-on OpenAI O / AON

Zaktualizowano September 27, 2026 · pierwsza publikacja September 27, 2026

Przeciekające odniesienia ujawniają „O” OpenAI (kodowa nazwa AON) – asystenta always-on zaprojektowanego do zadań o długim horyzoncie. W przeciwieństwie do modeli czatu, które odpowiadają i się zatrzymują, O dostaje własne środowisko chmurowe, może tworzyć konteksty wykonania, pisać kod, prowadzić badania i działać nieprzerwanie przez godziny, dni lub potencjalnie tygodnie. Może w tym uczestniczyć wielu agentów komunikujących się w tym samym zadaniu. Oczekiwane ogłoszenie: OpenAI Dev Day, 29 września 2026.

Co zmienia się w modelowaniu kosztów

Tradycyjny koszt LLM: tokeny na żądanie × stawka. Koszt O/AON: czas × przydzielona moc obliczeniowa + przepustowość tokenów.

WymiarAPI czatu/completionO / AON (prognoza)
Jednostka rozliczeniowaZa 1M tokenówZa godzinę (moc obliczeniowa) + za 1M tokenów
Koszt bezczynności$0>$0 (rezerwacja środowiska)
Maks. czas trwaniaMinuty (timeout)Dni/tygodnie
RównoległośćŻądania sekwencyjneRoje wielu agentów
StanPrzekazywany w kontekścieTrwałe środowisko

Prognozowany model kosztów (spekulatywny, oparty na wzorcach z wycieków)

OpenAI nie opublikowało cen. Dwie prawdopodobne struktury:

Opcja A: godzina obliczeniowa + tokeny (jak Codespaces)

Uruchomienie agenta trwające 24 godziny z 5M tokenów wejścia i 2M tokenów wyjścia:

SkładnikKoszt (niski)Koszt (wysoki)
Środowisko 24h ($1/h)$24$48
5M wejścia @ $5/MTok$25$25
2M wyjścia @ $15/MTok$30$30
Razem$79$103

Opcja B: płaska subskrypcja (pakiet Pro Max)

Strategie optymalizacji kosztów dla agentów always-on

  1. Hibernuj, nie kończ. Jeśli środowisko się utrzymuje, wstrzymuj pętlę agenta w okresach bezczynności zamiast ją wyłączać – zimny start kosztuje więcej niż rezerwacja bezczynności.
  2. Grupuj tokeny podzadań. Zbieraj wyniki podzadań i zapisuj kontekst w większych porcjach, by poprawić trafienia w cache w trwałym środowisku.
  3. Kieruj podzadania do tańszych modeli. O/AON orkiestruje; kodowanie deleguj do Sonnet 5.5, badania do modeli Flash, a na premium eskaluj tylko krytyczne decyzje.
  4. Ustaw twarde budżety czasu i pieniędzy na cel. „Rozwiąż ten błąd, maks. $10 / 2 godziny” – egzekwuj to w orkiestratorze, a nie licz na szczęście.

Kiedy O/AON, a kiedy długo działający Opus 5.5?

Dalsza lektura

Zobacz ekonomię ChatGPT Pro Max, ceny OpenAI Ultra Fast API, koszt 25-godzinnego agenta Opus 5.5 i ekonomię agentów.

Powiązane


Chcesz zastosować to w swoim stosie? Przynieś faktury dostawców, logi bramy i najważniejsze przepływy pracy; wskażemy czynniki kosztów i ścieżkę oszczędności. Umów bezpłatny audyt →

Wróć do finopsllm.com