Model kosztów agenta always-on OpenAI O / AON
Zaktualizowano September 27, 2026 · pierwsza publikacja September 27, 2026
Przeciekające odniesienia ujawniają „O” OpenAI (kodowa nazwa AON) – asystenta always-on zaprojektowanego do zadań o długim horyzoncie. W przeciwieństwie do modeli czatu, które odpowiadają i się zatrzymują, O dostaje własne środowisko chmurowe, może tworzyć konteksty wykonania, pisać kod, prowadzić badania i działać nieprzerwanie przez godziny, dni lub potencjalnie tygodnie. Może w tym uczestniczyć wielu agentów komunikujących się w tym samym zadaniu. Oczekiwane ogłoszenie: OpenAI Dev Day, 29 września 2026.
Co zmienia się w modelowaniu kosztów
Tradycyjny koszt LLM: tokeny na żądanie × stawka. Koszt O/AON: czas × przydzielona moc obliczeniowa + przepustowość tokenów.
| Wymiar | API czatu/completion | O / AON (prognoza) |
|---|---|---|
| Jednostka rozliczeniowa | Za 1M tokenów | Za godzinę (moc obliczeniowa) + za 1M tokenów |
| Koszt bezczynności | $0 | >$0 (rezerwacja środowiska) |
| Maks. czas trwania | Minuty (timeout) | Dni/tygodnie |
| Równoległość | Żądania sekwencyjne | Roje wielu agentów |
| Stan | Przekazywany w kontekście | Trwałe środowisko |
Prognozowany model kosztów (spekulatywny, oparty na wzorcach z wycieków)
OpenAI nie opublikowało cen. Dwie prawdopodobne struktury:
Opcja A: godzina obliczeniowa + tokeny (jak Codespaces)
- Rezerwacja środowiska: ok. $0.50-2.00/godzinę (CPU + pamięć + pamięć masowa)
- Przepustowość tokenów: standardowe stawki GPT-5 doliczane na wierzchu
- Poziom ultra fast: mnożnik tokenów 5-10x po włączeniu
Uruchomienie agenta trwające 24 godziny z 5M tokenów wejścia i 2M tokenów wyjścia:
| Składnik | Koszt (niski) | Koszt (wysoki) |
|---|---|---|
| Środowisko 24h ($1/h) | $24 | $48 |
| 5M wejścia @ $5/MTok | $25 | $25 |
| 2M wyjścia @ $15/MTok | $30 | $30 |
| Razem | $79 | $103 |
Opcja B: płaska subskrypcja (pakiet Pro Max)
- ChatGPT Pro Max za $500/mies. obejmuje dostęp do O/AON oraz pulę ultra fast
- Efektywnie za godzinę: $500 / 720 h = $0.69/h (przy pracy 24/7)
- Próg opłacalności względem opcji A: ok. 15 godzin dziennie stałego użycia
Strategie optymalizacji kosztów dla agentów always-on
- Hibernuj, nie kończ. Jeśli środowisko się utrzymuje, wstrzymuj pętlę agenta w okresach bezczynności zamiast ją wyłączać – zimny start kosztuje więcej niż rezerwacja bezczynności.
- Grupuj tokeny podzadań. Zbieraj wyniki podzadań i zapisuj kontekst w większych porcjach, by poprawić trafienia w cache w trwałym środowisku.
- Kieruj podzadania do tańszych modeli. O/AON orkiestruje; kodowanie deleguj do Sonnet 5.5, badania do modeli Flash, a na premium eskaluj tylko krytyczne decyzje.
- Ustaw twarde budżety czasu i pieniędzy na cel. „Rozwiąż ten błąd, maks. $10 / 2 godziny” – egzekwuj to w orkiestratorze, a nie licz na szczęście.
Kiedy O/AON, a kiedy długo działający Opus 5.5?
- O/AON: wielodniowe badania, ciągły monitoring, koordynacja wielu agentów, zadania wymagające trwałego stanu środowiska
- Pętla agenta Opus 5.5: zadania kodowe z jednym celem (godziny, nie dni), dobrze zdefiniowane rezultaty, wykonanie jednorazowe
Dalsza lektura
Zobacz ekonomię ChatGPT Pro Max, ceny OpenAI Ultra Fast API, koszt 25-godzinnego agenta Opus 5.5 i ekonomię agentów.
Powiązane
- Ekonomia ChatGPT Pro Max
- Ceny OpenAI Ultra Fast API
- Koszt 25-godzinnego agenta Opus 5.5
- Ekonomia agentów
Chcesz zastosować to w swoim stosie? Przynieś faktury dostawców, logi bramy i najważniejsze przepływy pracy; wskażemy czynniki kosztów i ścieżkę oszczędności. Umów bezpłatny audyt →