GPT-6 Lunaのコストモデル
更新日 September 23, 2026 · 初回公開 September 23, 2026
GPT-6 Lunaは、OpenAIのGPT-6ファミリーにおける低価格モデルで、2026年9月22日にGPT-6 Solと同時にリリースされました。OpenAIは、要約、抽出、簡単な質問といった大量処理向けと明確に位置づけています。入力1Mトークンあたり$0.10のため、最初にルーティングすべきモデルであり、タスクがそれ以上を必要とすると分かった場合にのみ別のモデルへ移すべきです。
GPT-6 Lunaの料金
| ティア | 入力 | キャッシュ入力 | 出力 |
|---|---|---|---|
| 標準 | $0.10 | $0.01 | $0.50 |
| バッチまたはフレックス | $0.05 | $0.005 | $0.25 |
| 高速モード | $0.20 | $0.02 | $1.00 |
| ロングコンテキスト(入力272K超) | $0.20 | $0.02 | $0.75 |
料金は1Mトークンあたりで、OpenAIの料金ページに基づきます。キャッシュ書き込みは$0.125です。Lunaは、GPT-6の他モデルと同じ1,050,000トークンのコンテキストウィンドウ、2026年5月のナレッジカットオフ(3モデルの中で最新)、noneからmaxまでの全エフォート範囲を備えています。
GPT-5.6 Lunaと同じスコアで、タスク単価は61%減
Artificial Analysisは、Intelligence Index(v4.3.2)で両世代のLunaを最大エフォートで評価しました。
| モデル | インデックススコア | タスク単価 | 出力速度 |
|---|---|---|---|
| GPT-6 Luna (max) | 37 | $0.07 | 132.2トークン/秒 |
| GPT-5.6 Luna (max) | 37 | $0.18 | 142.3トークン/秒 |
| GPT-6 Sol (low) | 33.9 | $0.13 | — |
スコアは変わりませんでした。タスク単価は61%下がり、主な要因はトークン単価の低下です。maxのGPT-6 Lunaは、lowエフォートのGPT-6 Solをスコアとコストの両面で上回ります。コストを抑えるためにSolをlowで使っていたのであれば、この指標ではmaxのLunaのほうが有利です。
大量処理のコスト
月100万件の分類リクエスト(各リクエストは入力600トークン、出力100トークン、キャッシュなし)の場合:
| モデル | 月額コスト |
|---|---|
| GPT-6 Luna(バッチ) | $55 |
| GPT-6 Luna | $110 |
| GPT-5.6 Luna | $240 |
| Claude Haiku 4.5 | $1,100 |
| GPT-6 Sol | $2,200 |
| GPT-6 Astra | $11,000 |
Claude Haiku 4.5はトークン単価が10×高く、推論なしのモデルとして同じ指標で15点でした。同じ処理をSolからLunaへ移すと請求額は95%減るため、難しいケースだけをSolに送るルーターを構築する価値があります。
注意点:レイテンシと冗長性
上記のインデックス値は最大エフォートのものであり、最大エフォートではLunaの応答開始が遅くなります。Artificial Analysisは最初のトークンまで104秒を計測しました。また、インデックス全体で出力トークンを150M使用しており、中央値の84Mを上回ります。Artificial Analysisはこれをやや冗長と評しています。この冗長性はすでにタスクあたり$0.07に含まれているためコスト値は変わりませんが、ユーザー向けチャットには待ち時間が適しません。
インタラクティブなトラフィックには、Lunaをnone、low、またはデフォルトのmediumで実行し、自社のプロンプトで精度を測定してください。このページのスコアは最大エフォートのみのものなので、低いエフォートでの精度は調べるのではなく、実際にテストする必要があります。最大エフォートは、レイテンシが問題にならず、バッチ料金でさらに半額になるバッチジョブに取っておきましょう。
レート制限はSolより大きく拡張
LunaはTier 1でSolと同じ毎分500Kトークンから始まりますが、Tier 5では毎分180Mトークンに達し(Solは40Mで頭打ち)、毎分最大30,000リクエストまで対応します。大規模なバルク処理パイプラインでは、この余裕は価格と同じくらい重要です。
Lunaの使い方
- タスクの種類でルーティングします。抽出、分類、タグ付け、短い要約はデフォルトでLunaに送ります。
- 急がない大量処理は、Batch APIを$0.05/$0.25で利用します。
- ルートごとにエフォートを選びます。インタラクティブはlow、オフラインジョブはmaxです。
- 最初からではなく、バリデーターがLunaの出力を却下したときにGPT-6 Solへエスカレーションします。
出典:OpenAI GPT-6 Lunaモデルページ、Artificial Analysis: GPT-6 Luna、Artificial Analysis: GPT-5.6 Luna、TechCrunch。料金は2026年9月23日時点です。
関連記事
この方法を自社の環境にも適用しますか? プロバイダーの請求書、ゲートウェイログ、主要なワークフローをお持ちください。コスト要因と削減策を整理します。 無料監査を予約 →