Claude Opus 5.5 コストモデル
Updated September 22, 2026 · first published September 22, 2026
Anthropic は 2026 年 9 月 22 日に Claude Opus 5.5(claude-opus-5-5)をリリースしました。見出し価格は百万入力トークンあたり $4、百万出力トークンあたり $20 で、Opus 5 の $5 と $25 からの低下です。これは 20% のカットです。ほとんどの本番ワークロードでは、実際のカットはより大きいです。なぜなら、最も動いたレートは見出しが除外するレートだからです。
重要なレート
| トークンタイプ | Opus 5.5 | Opus 5 | Fable 5.1 |
|---|---|---|---|
| 入力(キャッシュなし) | $4.00 / MTok | $5.00 / MTok | $10.00 / MTok |
| 出力 | $20.00 / MTok | $25.00 / MTok | $50.00 / MTok |
| キャッシュ書き込み(5 分) | $5.00 / MTok | $6.25 / MTok | $12.50 / MTok |
| キャッシュ読み取り | $0.20 / MTok | $0.50 / MTok | $0.25 / MTok |
| 高速モード(入力/出力) | $8 / $40 | — | — |
すべての行は 20% 低いですが、キャッシュ読み取りは 60% 低いです。$0.20 では Fable 5.1 の $0.25 より安くなりました。これは Fable がかつて勝った 1 つの行を反転させます。Fable 5.1 コストモデルでは、キャッシュの多いワークロードは Opus 5 より Fable の方が安い可能性がありました。Opus 5.5 に対してはもはやそうではありません。Fable はすべてのトークンタイプで多くの費用がかかります。
典型的なタスクが約 40% 安い理由
Anthropic の主張は典型的なジョブのコストが 40% 削減されることであり、20% ではありません。追加の部分はトークン効率から来ています。Anthropic は Opus 5.5 が約 20% 少ない入出力トークンで同じ結果に達し、約 40% 冗長性の低い出力を書くと述べています。低いレート掛ける少ないトークンが複合します:0.8 × 0.8 = 0.64、これは混合に応じてざっと 36-40% オフです。
これは 1 つのエージェントステップです:200,000 入力トークン、キャッシュから提供される 90%、20,000 出力トークン。
| 行 | Opus 5 | Opus 5.5(同じトークン) | Fable 5.1 |
|---|---|---|---|
| 20K キャッシュなし入力 | $0.100 | $0.080 | $0.200 |
| 180K キャッシュ入力 | $0.090 | $0.036 | $0.045 |
| 20K 出力 | $0.500 | $0.400 | $1.000 |
| 合計 | $0.690 | $0.516 | $1.245 |
同一トークンでは、Opus 5.5 はキャッシュ割引のため Opus 5 より 25% 安く、20% ではありません。20% トークン削減があなたのワークロードに当てはまる場合、ステップは約 $0.41 に低下し、これは Opus 5 より 40% 下で、Fable コストの 3 分の 1 です。出力はこの例では依然請求の約 80% です。これが冗長性削減の価値がある場所です。
GPT-6 Sol、GPT-6 Astra、Fable 5.1 とのタスクあたりコスト比較
100万トークンあたりの定価と、上と同じエージェントステップ(入力200K、うち90%キャッシュ、出力20K)を各モデルで計算した値です。
| モデル | 入力 $/MTok | 出力 $/MTok | キャッシュ読み取り $/MTok | 同一エージェントステップ |
|---|---|---|---|---|
| GPT-6 Sol | $2.00 | $10.00 | $0.20 | $0.276 |
| Claude Opus 5.5 | $4.00 | $20.00 | $0.20 | $0.516 |
| Claude Opus 5 | $5.00 | $25.00 | $0.50 | $0.690 |
| Claude Fable 5.1 | $10.00 | $50.00 | $0.25 | $1.245 |
| GPT-6 Astra | $10.00 | $50.00 | $1.00 | $1.380 |
Artificial Analysis Intelligence Index v4.3.2 での実測タスクあたりコスト(2026年9月22日時点、スコア順)。スコア47.5までは GPT-6 Sol が最安です。それを超えると、どの水準でも Opus 5.5 が最安です。Opus 5.5 high は1.82ドルで53.6、GPT-6 Astra max は3.26ドルで52.7、Fable 5.1 max は7.63ドルで53.4です。
| モデル | Intelligence Index | タスクあたりコスト | タスクあたり出力トークン |
|---|---|---|---|
| GPT-6 Sol · medium | 39.8 | $0.25 | 6,500 |
| GPT-6 Sol · xhigh | 44.1 | $0.53 | 16,000 |
| GPT-6 Astra · low | 45.8 | $0.82 | 4,400 |
| GPT-6 Sol · max | 47.5 | $1.06 | 31,200 |
| Claude Opus 5 · high | 48.1 | $3.61 | 46,200 |
| Claude Opus 5 · max | 50.8 | $5.86 | 72,500 |
| Claude Opus 5.5 · medium | 51.2 | $1.34 | 25,700 |
| Claude Fable 5.1 · high | 51.2 | $3.91 | 38,100 |
| GPT-6 Astra · max | 52.7 | $3.26 | 27,200 |
| Claude Fable 5.1 · max | 53.4 | $7.63 | 78,100 |
| Claude Opus 5.5 · high | 53.6 | $1.82 | 35,600 |
| Claude Opus 5.5 · max | 57.6 | $5.98 | 119,200 |
GPT-6 Astra の low より上の設定、Opus 5 の全設定、Fable 5.1 の全設定は、同等以上のスコアを出す Sol または Opus 5.5 の設定より高くつきます。タスクあたりコストはベンチマークのタスク構成に左右されます。モデルを切り替える前に自社のトラフィックで再現してください。
Fable を置き換えるのに十分ですか?
Anthropic は Opus 5.5 をほとんどのタスクで Fable 5.1 と一致するものとして位置付けています。公開されている数字はコーディングとエージェント作業でそれをサポートしています:
- Terminal-Bench 4.0: 66.4%、Opus 5 52.3%、Fable 5.1 55.8% に対して。
- FrontierCode v1.1: 54.4%、Opus 5 48.0%、Fable 5.1 50.3% に対して。
- CursorBench 4.0: 57.8%、Opus 5 46.6% に対して。
- GDPval-AA v2.1: 1846 Elo、Opus 5 1708 に対して。
Artificial Analysis はローンチ当日に Intelligence Index で最初にランク付けしました。Anthropic はまた、デフォルト(中)の努力で GPT-6 Astra を最大努力で知識作業に打ち負かし、タスクあたりのコストの約 5 分の 1 であると述べています。これはベンダー比較なので、それをテストする仮説として扱います。上記のコスト数学は、自分で検証できる部分です。
高速モードは 2× コスト
高速モードは $8 入力と $40 出力でコストがかかり、標準レートのちょうど 2 倍です。最大 2.5× の速度のため。標準モデルも Opus 5 より約 30% 高速です。ユーザーが待機している遅延バウンドインタラクティブパスで高速モードを使用してください。バッチジョブ、バックグラウンドエージェント、eval から除外してください。高速モードがデフォルトで有効な場合、単価は 2 倍になり、ダッシュボードは請求書が到着するまで何も珍しくは表示されません。
今週何をするか
- モデル ID をピンします。
claude-opus-5-5を明示的に指し、すべてのリクエストに ID を記録して、移行後のリクエストごとのコストをモデル別に分割できます。 - 独自のトラフィックで再ベースラインします。 実際のリクエストのサンプルを両方のモデルで再生し、呼び出しごとではなく、完了したタスクごとのトークンを比較します。20% トークン効率のクレームは、ワークロードごとに最も変動する可能性がある部分です。
- 努力設定を再確認します。 ワークロードが品質のために Fable または最大努力に移動した場合、最初に Opus 5.5 を中程度でテストしてください。それは Anthropic がベンチマークする設定です。
- Fable ルーティング決定を再実行します。 キャッシュの多いトラフィックを Fable に送信してより安いキャッシュ読み取りを得るすべてのルートを再評価する必要があります。そのコストの利点は消えました。
- キャッシュヒット率を監視します。 $4.00 に対して $0.20 では、キャッシュミスはヒットの 20× を超えるコストがかかります。プレフィックスを破るプロンプトテンプレート変更は、Opus 5 でそうであったより多くの費用がかかります。
Anthropic は Sonnet 5.5 と Haiku 5.5 が今後の週でフォローすると述べています。ステップ 2 からのリプレイハーネスを保持して、各リリースを午後で再ベースラインできます。
Related
Want this applied to your own LLM spend? FinOps LLM runs a free audit of your AI costs and shows where the savings are. Book free audit →