OpenAI O / AON 常時稼働エージェントのコストモデル
更新日 September 27, 2026 · 初回公開 September 27, 2026
流出した情報から、OpenAIの「O」(コードネームAON)の存在が明らかになりました。長期的なタスク向けに設計された常時稼働のアシスタントです。応答して終わるチャットモデルと異なり、Oは専用のクラウド環境を持ち、実行コンテキストを構築し、コードを書き、調査を行い、数時間、数日、場合によっては数週間にわたって継続的に動作できます。同じタスクについて複数のエージェントが連携する可能性もあります。発表が見込まれる場: OpenAI Dev Day(2026年9月29日)。
コストモデリングで何が変わるか
従来のLLMコスト:リクエストごとのトークン × 単価。O/AONのコスト:時間 × 割り当てられた計算資源 + トークンスループット。
| 項目 | チャット/Completion API | O / AON(予測) |
|---|---|---|
| 課金単位 | 1Mトークンあたり | 時間あたり(計算)+ 1Mトークンあたり |
| アイドル時のコスト | $0 | >$0(環境の予約) |
| 最大継続時間 | 数分(タイムアウト) | 数日〜数週間 |
| 並列性 | 逐次リクエスト | マルチエージェントの群れ |
| 状態 | コンテキストで受け渡し | 永続的な環境 |
予測コストモデル(流出パターンに基づく推測)
OpenAIは料金を公表していません。可能性の高い構造は次の2つです。
オプションA:計算時間 + トークン(Codespacesのような方式)
- 環境の予約:約$0.50〜2.00/時間(CPU + メモリ + ストレージ)
- トークンスループット:GPT-5の標準料金が別途加算
- ウルトラファストティア:有効化時にトークン5〜10倍の乗数
入力5M / 出力2Mトークンの24時間エージェント実行:
| 構成要素 | コスト(低) | コスト(高) |
|---|---|---|
| 24時間の環境($1/時) | $24 | $48 |
| 入力5M @ $5/MTok | $25 | $25 |
| 出力2M @ $15/MTok | $30 | $30 |
| 合計 | $79 | $103 |
オプションB:定額サブスクリプション(Pro Maxバンドル)
- 月額$500のChatGPT Pro MaxにO/AONへのアクセスとウルトラファストの利用枠が含まれる
- 実効の時間単価:$500 / 720時間 = $0.69/時(24/7稼働の場合)
- オプションAとの損益分岐:1日あたり約15時間の継続利用
常時稼働エージェントのコスト最適化戦略
- 終了せず、休止させる。環境が維持されるなら、アイドル期間はエージェントのループを停止するだけにして、環境は落とさないでください。コールドスタートのほうが、アイドル中の予約よりコストがかかります。
- サブタスクのトークンをまとめる。サブタスクの結果を蓄積し、コンテキストを大きな単位で書き込むことで、永続環境でのキャッシュヒット率を高めます。
- サブタスクは安価なモデルへルーティングする。O/AONはオーケストレーションを担い、コーディングはSonnet 5.5、調査はFlash系モデルに任せ、重要な判断にのみプレミアムモデルへエスカレーションします。
- 目標ごとに時間と金額の上限を設ける。「このバグを解決する。上限は$10 / 2時間」のように、期待に頼らずオーケストレーターで強制してください。
O/AONと長時間実行のOpus 5.5の使い分け
- O/AON:数日に及ぶ調査、継続的な監視、マルチエージェントの連携、永続的な環境状態が必要なタスク
- Opus 5.5のエージェントループ:単一目標のコーディングタスク(日単位ではなく時間単位)、明確に定義された成果物、一度で完結する実行
関連記事
ChatGPT Pro Maxの経済性、OpenAI Ultra Fast APIの料金、Opus 5.5の25時間エージェントのコスト、エージェントの経済性もご覧ください。
関連記事
この方法を自社の環境にも適用しますか? プロバイダーの請求書、ゲートウェイログ、主要なワークフローをお持ちください。コスト要因と削減策を整理します。 無料監査を予約 →