Model biaya agen selalu aktif OpenAI O / AON
Diperbarui September 27, 2026 · pertama terbit September 27, 2026
Referensi yang bocor mengungkap “O” dari OpenAI (nama sandi AON), yaitu asisten selalu aktif yang dirancang untuk tugas berhorizon panjang. Berbeda dengan model chat yang menjawab lalu berhenti, O mendapatkan lingkungan cloud sendiri, dapat menyiapkan konteks eksekusi, menulis kode, meneliti, dan beroperasi terus-menerus selama berjam-jam, berhari-hari, atau berpotensi berminggu-minggu. Ini bisa melibatkan beberapa agen yang saling berkomunikasi dalam satu tugas. Pengumuman yang diharapkan: OpenAI Dev Day, 29 September 2026.
Apa yang berubah untuk pemodelan biaya
Biaya LLM tradisional: token per permintaan × tarif. Biaya O/AON: waktu × komputasi yang dialokasikan + throughput token.
| Dimensi | API Chat/Completion | O / AON (proyeksi) |
|---|---|---|
| Satuan penagihan | Per 1M token | Per jam (komputasi) + per 1M token |
| Biaya saat diam | $0 | >$0 (pemesanan lingkungan) |
| Durasi maksimum | Menit (timeout) | Hari/minggu |
| Paralelisme | Permintaan berurutan | Kawanan multi-agen |
| Status | Dikirim dalam konteks | Lingkungan persisten |
Model biaya proyeksi (spekulatif, berdasarkan pola kebocoran)
OpenAI belum menerbitkan harga. Ada dua struktur yang mungkin:
Opsi A: jam komputasi + token (seperti Codespaces)
- Pemesanan lingkungan: sekitar $0.50-2.00/jam (CPU + memori + penyimpanan)
- Throughput token: tarif standar GPT-5 ditambahkan di atasnya
- Tingkat ultra cepat: pengali token 5-10x saat diaktifkan
Satu eksekusi agen 24 jam dengan 5M token input / 2M token output:
| Komponen | Biaya (rendah) | Biaya (tinggi) |
|---|---|---|
| Lingkungan 24 jam ($1/jam) | $24 | $48 |
| 5M input @ $5/MTok | $25 | $25 |
| 2M output @ $15/MTok | $30 | $30 |
| Total | $79 | $103 |
Opsi B: langganan tetap (paket Pro Max)
- ChatGPT Pro Max $500/bulan mencakup akses O/AON + kuota ultra cepat
- Efektif per jam: $500 / 720 jam = $0.69/jam (jika berjalan 24/7)
- Titik impas dengan Opsi A: sekitar 15 jam/hari penggunaan berkelanjutan
Strategi optimasi biaya untuk agen selalu aktif
- Hibernasi, jangan hentikan. Jika lingkungan tetap ada, jeda loop agen selama periode diam alih-alih mematikannya. Biaya cold start lebih mahal daripada biaya pemesanan saat diam.
- Kelompokkan token subtugas. Kumpulkan hasil subtugas dan tulis konteks dalam potongan yang lebih besar untuk meningkatkan rasio cache hit pada lingkungan persisten.
- Arahkan subtugas ke model yang lebih murah. O/AON mengatur orkestrasi; delegasikan coding ke Sonnet 5.5, riset ke model Flash, dan naik ke model premium hanya untuk keputusan kritis.
- Tetapkan anggaran waktu dan uang yang ketat per tujuan. “Selesaikan bug ini, maks $10 / 2 jam” dan terapkan melalui orkestrator, bukan berharap saja.
Kapan memakai O/AON dan kapan Opus 5.5 berjalan lama
- O/AON: riset berhari-hari, pemantauan berkelanjutan, koordinasi multi-agen, tugas yang membutuhkan state lingkungan yang persisten
- Loop agen Opus 5.5: tugas coding dengan satu tujuan (jam, bukan hari), hasil yang jelas batasannya, eksekusi sekali jalan
Bacaan terkait
Lihat ekonomi ChatGPT Pro Max, harga API Ultra Fast OpenAI, biaya agen 25 jam Opus 5.5, dan ekonomi agen.
Terkait
Ingin menerapkannya pada stack Anda? Bawa tagihan penyedia, log gateway, dan alur kerja utama; kami akan memetakan pendorong biaya dan jalur penghematan. Pesan audit gratis →