Claude Opus 5.5 成本模型

Updated September 22, 2026 · first published September 22, 2026

Anthropic 在 2026 年 9 月 22 日发布了 Claude Opus 5.5(claude-opus-5-5)。标题价格是每百万输入令牌 $4,每百万输出令牌 $20,下降自 Opus 5 的 $5 和 $25。这是 20% 的削减。对于大多数生产工作负载,实际削减更大,因为下降最多的速率是标题排除的速率。

重要的费率

令牌类型Opus 5.5Opus 5Fable 5.1
输入(未缓存)$4.00 / MTok$5.00 / MTok$10.00 / MTok
输出$20.00 / MTok$25.00 / MTok$50.00 / MTok
缓存写入(5 分钟)$5.00 / MTok$6.25 / MTok$12.50 / MTok
缓存读取$0.20 / MTok$0.50 / MTok$0.25 / MTok
快速模式(输入/输出)$8 / $40

除了缓存读取降低 60% 外,每一行都降低 20%。在 $0.20 时,现在比 Fable 5.1 的 $0.25 更便宜。这逆转了 Fable 曾经赢的那一行。在我们的 Fable 5.1 成本模型 中,缓存繁重的工作负载在 Fable 上可能比在 Opus 5 上更便宜。对于 Opus 5.5,情况不再如此。Fable 在每种令牌类型上的成本都更高。

为什么典型任务便宜约 40%

Anthropic 的声称是典型工作的成本降低 40%,而不是 20%。额外的来自令牌效率。Anthropic 说 Opus 5.5 用大约 20% 更少的输入和输出令牌达到相同的结果,并写大约 40% 冗余性更少的输出。较低的费率乘以较少的令牌会复合:0.8 × 0.8 = 0.64,这大约是 36-40% 的折扣,取决于混合。

这是一个代理步骤:200,000 输入令牌,90% 从缓存服务,20,000 输出令牌。

Opus 5Opus 5.5(相同令牌)Fable 5.1
20K 未缓存输入$0.100$0.080$0.200
180K 缓存输入$0.090$0.036$0.045
20K 输出$0.500$0.400$1.000
总计$0.690$0.516$1.245

在相同令牌上,Opus 5.5 由于缓存折扣比 Opus 5 便宜 25%,而不是 20%。如果 20% 令牌削减适用于您的工作负载,该步骤下降到约 $0.41,这比 Opus 5 低 40%,是 Fable 成本的三分之一。输出仍然是此示例中账单的约 80%。这是冗余性削减的收益所在。

与 GPT-6 Sol、GPT-6 Astra 和 Fable 5.1 的每任务成本对比

每百万 token 的标价,以及上文同一个 agent 步骤(输入 200K,其中 90% 命中缓存,输出 20K)在各模型上的价格。

模型输入 $/MTok输出 $/MTok缓存读取 $/MTok同一 agent 步骤
GPT-6 Sol$2.00$10.00$0.20$0.276
Claude Opus 5.5$4.00$20.00$0.20$0.516
Claude Opus 5$5.00$25.00$0.50$0.690
Claude Fable 5.1$10.00$50.00$0.25$1.245
GPT-6 Astra$10.00$50.00$1.00$1.380

在 Artificial Analysis Intelligence Index v4.3.2 上实测的每任务成本(读取于 2026 年 9 月 22 日,按得分排序)。47.5 分以内,GPT-6 Sol 是最便宜的选择。高于此分数,Opus 5.5 在每个档位都最便宜:Opus 5.5 high 以 1.82 美元拿到 53.6 分,而 GPT-6 Astra max 以 3.26 美元拿到 52.7 分,Fable 5.1 max 以 7.63 美元拿到 53.4 分。

模型Intelligence Index每任务成本每任务输出 token
GPT-6 Sol · medium39.8$0.256,500
GPT-6 Sol · xhigh44.1$0.5316,000
GPT-6 Astra · low45.8$0.824,400
GPT-6 Sol · max47.5$1.0631,200
Claude Opus 5 · high48.1$3.6146,200
Claude Opus 5 · max50.8$5.8672,500
Claude Opus 5.5 · medium51.2$1.3425,700
Claude Fable 5.1 · high51.2$3.9138,100
GPT-6 Astra · max52.7$3.2627,200
Claude Fable 5.1 · max53.4$7.6378,100
Claude Opus 5.5 · high53.6$1.8235,600
Claude Opus 5.5 · max57.6$5.98119,200

GPT-6 Astra 高于 low 的所有设置、Opus 5 的所有设置以及 Fable 5.1 的所有设置,都比得分相同或更高的 Sol 或 Opus 5.5 设置更贵。每任务成本取决于基准测试的任务构成。切换模型前请用自己的流量回放验证。

它足以取代 Fable 吗?

Anthropic 将 Opus 5.5 定位为在大多数任务上与 Fable 5.1 匹配。已发布的数字支持编码和代理工作:

Artificial Analysis 在发布当天在其 Intelligence Index 上排名第一。Anthropic 还表示,在默认(中等)努力下,它在知识工作中击败每项任务成本约五分之一的 GPT-6 Astra 最大努力。这是供应商比较,因此请将其视为要测试的假设。上面的成本数学是您可以自己验证的部分。

快速模式成本 2×

快速模式成本 $8 输入和 $40 输出,恰好是标准费率的两倍,速度最高可达 2.5×。标准模型也比 Opus 5 快约 30%。对于延迟受限的交互式路径,其中用户正在等待时,使用快速模式。将其从批处理作业、后台代理和评估中保留。启用快速模式作为默认时,单位成本翻倍,仪表板在发票到达之前显示任何异常。

本周做什么

  1. 固定模型 ID。 将生产明确指向 claude-opus-5-5 并在每个请求上记录 ID,以便迁移后可按模型拆分每个请求的成本。
  2. 在您自己的流量上重新基线。 在两个模型上重放实际请求的样本,并比较每个完成任务的令牌,而不是每个调用。20% 令牌效率声称是最可能因工作负载而异的部分。
  3. 重新检查努力设置。 如果工作负载转移到 Fable 或最大努力以获得质量,请先在中等级别测试 Opus 5.5。这是 Anthropic 基准测试的设置。
  4. 重新运行 Fable 路由决定。 任何将缓存繁重流量发送到 Fable 以获得更便宜缓存读取的路由都应重新评估。该成本优势消失了。
  5. 监视缓存命中率。 在 $4.00 的 $0.20 处,缓存未命中现在花费命中的 20 倍。打破前缀的提示模板更改比在 Opus 5 上花费的成本更高。

Anthropic 表示 Sonnet 5.5 和 Haiku 5.5 将在接下来的几周内推出。从第 2 步保持重放线束,以便可在午后重新基线每个发布。

Related


Want this applied to your own LLM spend? FinOps LLM runs a free audit of your AI costs and shows where the savings are. Book free audit →

Back to research