Kostenmodel van de OpenAI O / AON always-on agent
Bijgewerkt September 27, 2026 · eerst gepubliceerd September 27, 2026
Gelekte verwijzingen onthullen OpenAI's 'O' (codenaam AON) — een always-on assistent ontworpen voor taken met een lange horizon. In tegenstelling tot chatmodellen die antwoorden en stoppen, krijgt O een eigen cloudomgeving, kan uitvoeringscontexten opzetten, code schrijven, onderzoek doen en continu werken gedurende uren, dagen of mogelijk weken. Meerdere agents kunnen aan dezelfde taak communiceren. Verwachte onthulling: OpenAI Dev Day, 29 september 2026.
Wat verandert er voor kostenmodellering
Traditionele LLM-kosten: tokens per request × tarief. O/AON-kosten: tijd × toegewezen compute + tokendoorvoer.
| Dimensie | Chat/Completion API | O / AON (geprojecteerd) |
|---|---|---|
| Factureringseenheid | Per 1M tokens | Per uur (compute) + per 1M tokens |
| Kosten bij inactiviteit | $0 | >$0 (reservering van de omgeving) |
| Maximale duur | Minuten (timeout) | Dagen/weken |
| Parallellisme | Opeenvolgende requests | Multi-agentzwermen |
| State | Meegegeven in context | Persistente omgeving |
Geprojecteerd kostenmodel (speculatief, gebaseerd op lekpatronen)
OpenAI heeft geen prijzen gepubliceerd. Twee waarschijnlijke structuren:
Optie A: computeuur + tokens (zoals Codespaces)
- Reservering van de omgeving: ~$0.50-2.00/uur (CPU + geheugen + opslag)
- Tokendoorvoer: standaard GPT-5-tarieven er bovenop
- Ultra-fast-tier: 5-10x tokenvermenigvuldiger indien ingeschakeld
Een agentrun van 24 uur met 5M input / 2M outputtokens:
| Component | Kosten (laag) | Kosten (hoog) |
|---|---|---|
| 24 uur omgeving ($1/uur) | $24 | $48 |
| 5M input @ $5/MTok | $25 | $25 |
| 2M output @ $15/MTok | $30 | $30 |
| Totaal | $79 | $103 |
Optie B: vast abonnement (Pro Max-bundel)
- $500/mnd ChatGPT Pro Max omvat toegang tot O/AON + ultra-fast-quotum
- Effectief per uur: $500 / 720u = $0.69/uur (bij 24/7)
- Break-even ten opzichte van optie A: ~15 uur per dag aanhoudend gebruik
Kostenoptimalisatiestrategieën voor always-on agents
- Hiberneer, beëindig niet. Als de omgeving blijft bestaan, pauzeer dan de agentloop tijdens inactieve perioden in plaats van af te sluiten — een koude start kost meer dan een inactieve reservering.
- Bundel tokens van subtaken. Verzamel resultaten van subtaken en schrijf context in grotere brokken om de cachetreffer-ratio op de persistente omgeving te verbeteren.
- Route subtaken naar goedkopere modellen. O/AON orkestreert; delegeer codering aan Sonnet 5.5, onderzoek aan Flash-modellen en escaleer alleen naar premium voor kritieke beslissingen.
- Stel harde tijd-/geldbudgetten per doel. 'Los deze bug op, max $10 / 2 uur' — dwing af via de orchestrator, hoop niet.
Wanneer O/AON versus de langlopende Opus 5.5
- O/AON: onderzoek van meerdere dagen, continue monitoring, multi-agentcoördinatie, taken die persistente omgevingsstate nodig hebben
- Opus 5.5-agentloop: codeertaken met één doel (uren, geen dagen), duidelijk gedefinieerde opleveringen, eenmalige uitvoering
Verwante lectuur
Zie economie van ChatGPT Pro Max, prijzen van de OpenAI Ultra Fast API, kosten van de 25-uurs Opus 5.5-agent en agenteconomie.
Gerelateerd
- Economie van ChatGPT Pro Max
- Prijzen van de OpenAI Ultra Fast API
- Kosten van de 25-uurs Opus 5.5-agent
- Agenteconomie
Wilt u dit toepassen op uw stack? Neem leveranciersfacturen, gatewaylogs en de belangrijkste workflows mee; we brengen kostenfactoren en besparingskansen in kaart. Plan een gratis audit →