Claude Opus 5.5 コストモデル

Updated September 22, 2026 · first published September 22, 2026

Anthropic は 2026 年 9 月 22 日に Claude Opus 5.5(claude-opus-5-5)をリリースしました。見出し価格は百万入力トークンあたり $4、百万出力トークンあたり $20 で、Opus 5 の $5 と $25 からの低下です。これは 20% のカットです。ほとんどの本番ワークロードでは、実際のカットはより大きいです。なぜなら、最も動いたレートは見出しが除外するレートだからです。

重要なレート

トークンタイプOpus 5.5Opus 5Fable 5.1
入力(キャッシュなし)$4.00 / MTok$5.00 / MTok$10.00 / MTok
出力$20.00 / MTok$25.00 / MTok$50.00 / MTok
キャッシュ書き込み(5 分)$5.00 / MTok$6.25 / MTok$12.50 / MTok
キャッシュ読み取り$0.20 / MTok$0.50 / MTok$0.25 / MTok
高速モード(入力/出力)$8 / $40

すべての行は 20% 低いですが、キャッシュ読み取りは 60% 低いです。$0.20 では Fable 5.1 の $0.25 より安くなりました。これは Fable がかつて勝った 1 つの行を反転させます。Fable 5.1 コストモデルでは、キャッシュの多いワークロードは Opus 5 より Fable の方が安い可能性がありました。Opus 5.5 に対してはもはやそうではありません。Fable はすべてのトークンタイプで多くの費用がかかります。

典型的なタスクが約 40% 安い理由

Anthropic の主張は典型的なジョブのコストが 40% 削減されることであり、20% ではありません。追加の部分はトークン効率から来ています。Anthropic は Opus 5.5 が約 20% 少ない入出力トークンで同じ結果に達し、約 40% 冗長性の低い出力を書くと述べています。低いレート掛ける少ないトークンが複合します:0.8 × 0.8 = 0.64、これは混合に応じてざっと 36-40% オフです。

これは 1 つのエージェントステップです:200,000 入力トークン、キャッシュから提供される 90%、20,000 出力トークン。

Opus 5Opus 5.5(同じトークン)Fable 5.1
20K キャッシュなし入力$0.100$0.080$0.200
180K キャッシュ入力$0.090$0.036$0.045
20K 出力$0.500$0.400$1.000
合計$0.690$0.516$1.245

同一トークンでは、Opus 5.5 はキャッシュ割引のため Opus 5 より 25% 安く、20% ではありません。20% トークン削減があなたのワークロードに当てはまる場合、ステップは約 $0.41 に低下し、これは Opus 5 より 40% 下で、Fable コストの 3 分の 1 です。出力はこの例では依然請求の約 80% です。これが冗長性削減の価値がある場所です。

GPT-6 Sol、GPT-6 Astra、Fable 5.1 とのタスクあたりコスト比較

100万トークンあたりの定価と、上と同じエージェントステップ(入力200K、うち90%キャッシュ、出力20K)を各モデルで計算した値です。

モデル入力 $/MTok出力 $/MTokキャッシュ読み取り $/MTok同一エージェントステップ
GPT-6 Sol$2.00$10.00$0.20$0.276
Claude Opus 5.5$4.00$20.00$0.20$0.516
Claude Opus 5$5.00$25.00$0.50$0.690
Claude Fable 5.1$10.00$50.00$0.25$1.245
GPT-6 Astra$10.00$50.00$1.00$1.380

Artificial Analysis Intelligence Index v4.3.2 での実測タスクあたりコスト(2026年9月22日時点、スコア順)。スコア47.5までは GPT-6 Sol が最安です。それを超えると、どの水準でも Opus 5.5 が最安です。Opus 5.5 high は1.82ドルで53.6、GPT-6 Astra max は3.26ドルで52.7、Fable 5.1 max は7.63ドルで53.4です。

モデルIntelligence Indexタスクあたりコストタスクあたり出力トークン
GPT-6 Sol · medium39.8$0.256,500
GPT-6 Sol · xhigh44.1$0.5316,000
GPT-6 Astra · low45.8$0.824,400
GPT-6 Sol · max47.5$1.0631,200
Claude Opus 5 · high48.1$3.6146,200
Claude Opus 5 · max50.8$5.8672,500
Claude Opus 5.5 · medium51.2$1.3425,700
Claude Fable 5.1 · high51.2$3.9138,100
GPT-6 Astra · max52.7$3.2627,200
Claude Fable 5.1 · max53.4$7.6378,100
Claude Opus 5.5 · high53.6$1.8235,600
Claude Opus 5.5 · max57.6$5.98119,200

GPT-6 Astra の low より上の設定、Opus 5 の全設定、Fable 5.1 の全設定は、同等以上のスコアを出す Sol または Opus 5.5 の設定より高くつきます。タスクあたりコストはベンチマークのタスク構成に左右されます。モデルを切り替える前に自社のトラフィックで再現してください。

Fable を置き換えるのに十分ですか?

Anthropic は Opus 5.5 をほとんどのタスクで Fable 5.1 と一致するものとして位置付けています。公開されている数字はコーディングとエージェント作業でそれをサポートしています:

Artificial Analysis はローンチ当日に Intelligence Index で最初にランク付けしました。Anthropic はまた、デフォルト(中)の努力で GPT-6 Astra を最大努力で知識作業に打ち負かし、タスクあたりのコストの約 5 分の 1 であると述べています。これはベンダー比較なので、それをテストする仮説として扱います。上記のコスト数学は、自分で検証できる部分です。

高速モードは 2× コスト

高速モードは $8 入力と $40 出力でコストがかかり、標準レートのちょうど 2 倍です。最大 2.5× の速度のため。標準モデルも Opus 5 より約 30% 高速です。ユーザーが待機している遅延バウンドインタラクティブパスで高速モードを使用してください。バッチジョブ、バックグラウンドエージェント、eval から除外してください。高速モードがデフォルトで有効な場合、単価は 2 倍になり、ダッシュボードは請求書が到着するまで何も珍しくは表示されません。

今週何をするか

  1. モデル ID をピンします。 claude-opus-5-5 を明示的に指し、すべてのリクエストに ID を記録して、移行後のリクエストごとのコストをモデル別に分割できます。
  2. 独自のトラフィックで再ベースラインします。 実際のリクエストのサンプルを両方のモデルで再生し、呼び出しごとではなく、完了したタスクごとのトークンを比較します。20% トークン効率のクレームは、ワークロードごとに最も変動する可能性がある部分です。
  3. 努力設定を再確認します。 ワークロードが品質のために Fable または最大努力に移動した場合、最初に Opus 5.5 を中程度でテストしてください。それは Anthropic がベンチマークする設定です。
  4. Fable ルーティング決定を再実行します。 キャッシュの多いトラフィックを Fable に送信してより安いキャッシュ読み取りを得るすべてのルートを再評価する必要があります。そのコストの利点は消えました。
  5. キャッシュヒット率を監視します。 $4.00 に対して $0.20 では、キャッシュミスはヒットの 20× を超えるコストがかかります。プレフィックスを破るプロンプトテンプレート変更は、Opus 5 でそうであったより多くの費用がかかります。

Anthropic は Sonnet 5.5 と Haiku 5.5 が今後の週でフォローすると述べています。ステップ 2 からのリプレイハーネスを保持して、各リリースを午後で再ベースラインできます。

Related


Want this applied to your own LLM spend? FinOps LLM runs a free audit of your AI costs and shows where the savings are. Book free audit →

Back to research