LLM API価格トラッカー

更新 2026年7月15日 · 初回公開 2026年7月4日

主要なLLMプロバイダー全体のトークン単価を追跡。入力、出力、キャッシュ読み書き、コンテキストウィンドウ、バッチ割引を一つの正規化テーブルで。検証可能なプロバイダーデータで毎月更新。

12+追跡プロバイダー
25+掲載モデル
6価格列
2026年7月最終更新

方法論

収集

プロバイダーの公式価格ページおよびAPIドキュメントから価格データを収集。

正規化

全価格をUSD/100万トークンに正規化して直接比較可能に。

キャッシュ価格

キャッシュ読み書き列は、プロバイダーがサポートするプロンプトキャッシュの割引を表示。

表示ポリシー

公式値と推定値は明確に分離。推定値はグレーでマーク。

更新履歴

2026年7月4日

LLM API価格トラッカー公開

12以上の主要LLMプロバイダーにわたるトークン単価比較をFinOps LLMのリサーチ記事として公開。

トークン単価テーブル

プロバイダー モデル 入力 $/1M 出力 $/1M キャッシュ読取 $/1M キャッシュ書込 $/1M コンテキストウィンドウ バッチ割引
OpenAI GPT-5.6-Sol $5.00 $30.00 $0.50 $6.25 128K 50%
OpenAI GPT-5.6-Terra $2.50 $15.00 $0.25 $3.13 128K 50%
OpenAI GPT-5.6-Luna $1.00 $6.00 $0.10 $1.25 128K 50%
OpenAI GPT-5.5 $5.00 $30.00 $0.50 $6.25 128K 50%
OpenAI GPT-5.4 $2.50 $15.00 $0.25 $3.13 128K 50%
OpenAI o3 $2.00 $8.00 $0.50 $2.00 200K 50%
OpenAI o4-mini $1.10 $4.40 $0.28 $1.10 200K 50%
Anthropic Claude Fable 5 $10.00 $50.00 $1.00 $12.50 200K 50%
Anthropic Claude Opus 4.8 $5.00 $25.00 $0.50 $6.25 200K 50%
Anthropic Claude Sonnet 5* $2.00 $10.00 $0.20 $2.50 200K 50%
Anthropic Claude Haiku 4.5 $1.00 $5.00 $0.10 $1.25 200K 50%
Google Gemini 3.5 Flash $1.50 $9.00 $0.15 $1.88 1M 50%
Google Gemini 3.1 Pro Preview $2.00 $12.00 $0.20 $2.50 1M 50%
Google Gemini 2.5 Pro $1.25 $5.00 $0.31 $4.50 1M 50%
Google Gemini 2.5 Flash $0.15 $0.60 $0.04 $0.15 1M 50%
xAI Grok 4.5 $2.00 $6.00 $0.50 $1.50 1M 50%
xAI Grok 4.3 $1.25 $2.50 - - 1M 50%
Meta Llama 4 Maverick (DeepInfra) $0.20 $0.80 - - 1M -
Meta Llama 4 Scout (Groq) $0.11 $0.34 - - 5M -
Meta Llama 3.3 70B (Groq) $0.59 $0.79 - - 8M -
Mistral Mistral Large 2/3 $2.00 $6.00 - - 128K -
Mistral Mistral Medium 3.5 $1.50 $7.50 - - 128K -
Mistral Mistral Small 3 $0.10 $0.30 - - 128K -
Mistral Codestral $0.30 $0.90 - - 128K -
DeepSeek DeepSeek V4 Flash $0.14 $0.28 $0.0028 - 128K -
DeepSeek DeepSeek V4 Pro $0.435 $0.87 $0.0036 - 128K -
Alibaba Qwen Qwen 3.7-Max $2.50 $7.50 - - 131K -
Moonshot Kimi Kimi K2.6 $0.95 $4.00 $0.16 - 200K -
Xiaomi MiMO
登録 - お互いに$2取得 ↗
MiMo-V2-Pro $0.50 $2.00 - - 128K -
Xiaomi MiMO
登録 - お互いに$2取得 ↗
MiMo-V2-Omni $0.40 $1.60 - - 128K -
Zhipu AI GLM-5 $1.00 $4.00 - - 128K -
Zhipu AI GLM-5-Turbo $0.30 $1.20 - - 128K -
MiniMax M2.7 $0.40 $1.60 - - 128K -
StepFun step-3.5-flash $0.30 $1.20 - - 128K -

* Claude Sonnet 5: 入門価格$2/$10/100万トークンは2026年8月31日まで有効。標準価格$3/$15は2026年9月1日から開始。

プロバイダーが明示的に提供していない値はグレーで表示されています。

Meta Llamaの価格はホストAPI価格(Fireworks、Togetherなど)を反映しており、セルフホストコストではありません。セルフホストの経済性についてはオープンソース vs クローズドソースコスト比較をご覧ください。

コンテキストウィンドウは最大対応値です。実際の可用性はティアにより異なる場合があります。

キャッシュ読み書き価格は、プロバイダーがサポートするプロンプトキャッシュ固有の割引を反映しています。"-"はプロバイダーがキャッシュを提供していないか、価格が公開されていないことを意味します。

バッチ割引は、バッチ/非同期API使用時の概算節約額を示しています。

一部のリンクには紹介コードが含まれる場合があります。

価格は頻繁に変更される可能性があります。最新情報はプロバイダーの公式ページでご確認ください。

実践ガイド

コスト計画にこの価格データを活用する方法

1) まずトークン量を見積もる

価格を比較する前に、月間の入力・出力トークン量を見積もりましょう。出力トークンは入力より3〜5倍高価なため、出力長を削減することがコストに最も大きな影響を与えます。

2) キャッシュ節約を考慮する

ワークロードに繰り返しのシステムプロンプトやコンテキスト(RAG、マルチターン会話)がある場合、プロンプトキャッシュにより入力コストを50〜90%削減できます。適用可能な割引についてはキャッシュ読取列をご確認ください。

3) 非緊急作業にはバッチAPIを使用

主要プロバイダーの多くはバッチ/非同步APIコールで50%の割引を提供しています。ワークロードがレイテンシーを許容する場合(評価、データ処理、コンテンツ生成)、バッチ価格でコストを半減できます。

4) トークン単価だけでなく総コストで比較

品質を同等にするのに3倍多くのトークンが必要な安価なモデルは、全体としてより高コストになる可能性があります。モデル品質とタスク固有のパフォーマンスを価格とあわせて考慮しましょう。


ご自身のLLM支出にこれを適用しませんか?FinOps LLMはAIコストの無料監査を実施し、節約のポイントを示します。無料監査を予約 →

リサーチに戻る