GPT-5はいくらかかる?
更新日:2026年7月15日 · 最初の公開日:2026年7月4日
GPT-5はOpenAIの2026年リリースのフラッグシップ推論モデルです。複雑な推論、コーディング、マルチモーダルタスクにおいてGPT-5はGPT-4oを大幅に上回る性能を提供しますが - プレミアム価格が設定されています。このガイドでは、API価格、ChatGPTサブスクリプションティア、GPT-4oとの比較、そしてMiMOのような安価な代替手段が賢明な選択となる場面について、すべてのコスト要因を解説します。
GPT-5 API価格
OpenAIはGPT-5を100万トークンあたりで課金し、入力、出力、キャッシュ入力で異なる料金を設定しています。キャッシュ読み取りは、モデルが以前に計算されたプレフィックスを再利用するため、大幅に安価です。
| ティア | 入力 $/1M | 出力 $/1M | キャッシュ読取 $/1M | コンテキストウィンドウ |
|---|---|---|---|---|
| GPT-5.6-Sol (最大) | $5.00 | $30.00 | $0.50 | 128Kトークン |
| GPT-5.6-Terra (中程度) | $2.50 | $15.00 | $0.25 | 128Kトークン |
| GPT-5.6-Luna (予算重視) | $1.00 | $6.00 | $0.10 | 128Kトークン |
| GPT-5.5 (フラッグシップ) | $5.00 | $30.00 | $0.50 | 128Kトークン |
| GPT-5.4 (中堅) | $2.50 | $15.00 | $0.25 | 128Kトークン |
OpenAIの新しい2026年7月世代(GPT-5.6)は、3つの異なるティアを導入します:フロンティア推論用のSol、バランスの取れたパフォーマンス用のTerra、コスト意識的なユースケース用のLunaです。比較として、古いGPT-5.5および5.4モデルは引き続き利用可能です。GPT-5.6および5.5は$5/$30で、GPT-4o($2.50/$10)よりも大幅に高い機能を備えていますが、実効コストは推論の深さとキャッシュの効率に依存します。
ChatGPTサブスクリプションコスト
APIではなくChatGPTインターフェースを通じてGPT-5を使用する場合、価格はサブスクリプションベースです:
| プラン | 月額 | GPT-5アクセス | 主な制限 |
|---|---|---|---|
| Free | $0 | GPT-5 miniのみ | 1日のメッセージ数制限あり |
| Plus | $20/月 | GPT-5(上限あり) | ~80メッセージ/3時間 |
| Pro | $200/月 | GPT-5無制限 | レート制限なし、音声、ディープリサーチ |
| Team | $25/ユーザー/月 | GPT-5(上限緩和) | 管理ツール、SSO、上限緩和 |
| Enterprise | カスタム | GPT-5無制限 | SLA、専任サポート、データガバナンス |
月額$200のProプランは、ヘビーユーザーでない限りコスト効率が高くありません。ほとんどの開発者やチームにとって、慎重なトークン管理を行ったAPIの方がProサブスクリプションより安価です。
GPT-5 vs GPT-4o:アップグレードが合理的なタイミング
価格差は現実的です。そのため、GPT-5の品質優位が他のコスト削減に繋がるかどうかが重要な質問です:
- GPT-5を使用すべき場面:タスクが複数ステップの推論、複雑なコード生成、長文書分析、または単一の高品質パスが複数のリトライサイクルを節約するエージェント型ワークフローを必要とする場合。
- GPT-4oを使用すべき場面:タスクが単純な場合 - 分類、抽出、短文の要約、シンプルなチャット、またはスループットがリクエストあたりの知性より重要な大量バッチ処理。
- GPT-5 miniまたはnanoを使用すべき場面:GPT-5レベルの指示追従が必要だがコストを抑えたい場合、やや推論深度が低下しても許容できる場合。
実践的なルール:GPT-4oのプロンプトに思考連鎖の指示やマルチターンの修正ループが含まれている場合、GPT-5はその推論をネイティブに単一の呼び出しで行うため、実際には安くなる可能性があります。
GPT-5コストの削減方法
複数の戦略により、出力品質を犠牲にすることなくGPT-5の請求書を30〜70%削減できます:
- プロンプトキャッシュを活用。GPT-5のキャッシュ読取料金($2.50/1M)は入力料金の75%安価です。安定したプレフィックス(システム指示、コンテキスト)と可変サフィックス(ユーザークエリ)でプロンプトを構成し、キャッシュヒットを最大化しましょう。
- ルーティングにGPT-5 mini/nanoを使用。まず軽量モデルで意図を分類し、複雑なクエリにのみフルのGPT-5にエスカレートします。これがモデルルーティングパターンです。
- 非対話型作業にバッチAPI。OpenAIのバッチAPIは非同期ワークロードで50%の割引を提供 - 評価、エンリッチメント、レポート生成に最適です。
- コンテキストウィンドウを適正サイズに。5Kで十分な場合に100Kトークンのコンテキストを送信しないでください。不要な入力トークンはGPT-5ではGPT-4oの4倍のコストがかかります。
- 代替手段を検討。多くのコーディングや推論タスクでは、MiMO、DeepSeek R1、Claude Sonnetなどのモデルが品質と同等のものをコストの一部で提供します。プロバイダー裁定取引でベンチマークを取りましょう。
定価以外の隠れたコスト
トークンあたりの料金は全体の一部に過ぎません。これらの追加要因を予算に計上しましょう:
- 推論トークン。GPT-5は複雑なタスクに内部推論トークンを使用します。これらは出力料金($30/1M)で課金され、難しい問題では実質的な出力ボリュームを2〜5倍に増加させる可能性があります。
- リトライコスト。プロンプトが曖昧であったりパースが脆い場合、失敗した試行でもトークンを消費します。堅牢なプロンプトエンジニアリングは自己投資となります。
- 評価コスト。開発中のテストとベンチマーキングは、別途追跡しない限り本番コストを簡単に超える可能性があります。評価コスト配分を参照してください。
結論
GPT-5は高価ですが一律ではありません。100万トークンあたり$10/$30で、入力1,000トークンと出力500トークンの典型的なAPI呼び出しは約$0.025です。大量のアプリケーションでは請求書が急速に増加しますが - スマートなキャッシュ、ルーティング、バッチ処理によりコストを半分以下に削減できます。すべてのリクエストを追跡し、機能にコストを配分し、定期的に代替手段をベンチマークしましょう。
関連記事
- LLMプロバイダーはどのように課金するのか? - 数字の裏にある価格モデル。
- モデルルーティング - 正しいリクエストを正しいモデルに送る。
- プロバイダー裁定取引 - 品質基準を満たす最安のモデルを見つける。
- プロンプトキャッシュの説明 - 実際にキャッシュヒットを得る方法。
これを自分のLLM支出に適用しませんか?FinOps LLMはAIコストの無料監査を実行し、節約の場所を示します。無料監査を予約 →