Claude Opus 5.5 成本模型
Updated September 22, 2026 · first published September 22, 2026
Anthropic 在 2026 年 9 月 22 日发布了 Claude Opus 5.5(claude-opus-5-5)。标题价格是每百万输入令牌 $4,每百万输出令牌 $20,下降自 Opus 5 的 $5 和 $25。这是 20% 的削减。对于大多数生产工作负载,实际削减更大,因为下降最多的速率是标题排除的速率。
重要的费率
| 令牌类型 | Opus 5.5 | Opus 5 | Fable 5.1 |
|---|---|---|---|
| 输入(未缓存) | $4.00 / MTok | $5.00 / MTok | $10.00 / MTok |
| 输出 | $20.00 / MTok | $25.00 / MTok | $50.00 / MTok |
| 缓存写入(5 分钟) | $5.00 / MTok | $6.25 / MTok | $12.50 / MTok |
| 缓存读取 | $0.20 / MTok | $0.50 / MTok | $0.25 / MTok |
| 快速模式(输入/输出) | $8 / $40 | — | — |
除了缓存读取降低 60% 外,每一行都降低 20%。在 $0.20 时,现在比 Fable 5.1 的 $0.25 更便宜。这逆转了 Fable 曾经赢的那一行。在我们的 Fable 5.1 成本模型 中,缓存繁重的工作负载在 Fable 上可能比在 Opus 5 上更便宜。对于 Opus 5.5,情况不再如此。Fable 在每种令牌类型上的成本都更高。
为什么典型任务便宜约 40%
Anthropic 的声称是典型工作的成本降低 40%,而不是 20%。额外的来自令牌效率。Anthropic 说 Opus 5.5 用大约 20% 更少的输入和输出令牌达到相同的结果,并写大约 40% 冗余性更少的输出。较低的费率乘以较少的令牌会复合:0.8 × 0.8 = 0.64,这大约是 36-40% 的折扣,取决于混合。
这是一个代理步骤:200,000 输入令牌,90% 从缓存服务,20,000 输出令牌。
| 行 | Opus 5 | Opus 5.5(相同令牌) | Fable 5.1 |
|---|---|---|---|
| 20K 未缓存输入 | $0.100 | $0.080 | $0.200 |
| 180K 缓存输入 | $0.090 | $0.036 | $0.045 |
| 20K 输出 | $0.500 | $0.400 | $1.000 |
| 总计 | $0.690 | $0.516 | $1.245 |
在相同令牌上,Opus 5.5 由于缓存折扣比 Opus 5 便宜 25%,而不是 20%。如果 20% 令牌削减适用于您的工作负载,该步骤下降到约 $0.41,这比 Opus 5 低 40%,是 Fable 成本的三分之一。输出仍然是此示例中账单的约 80%。这是冗余性削减的收益所在。
与 GPT-6 Sol、GPT-6 Astra 和 Fable 5.1 的每任务成本对比
每百万 token 的标价,以及上文同一个 agent 步骤(输入 200K,其中 90% 命中缓存,输出 20K)在各模型上的价格。
| 模型 | 输入 $/MTok | 输出 $/MTok | 缓存读取 $/MTok | 同一 agent 步骤 |
|---|---|---|---|---|
| GPT-6 Sol | $2.00 | $10.00 | $0.20 | $0.276 |
| Claude Opus 5.5 | $4.00 | $20.00 | $0.20 | $0.516 |
| Claude Opus 5 | $5.00 | $25.00 | $0.50 | $0.690 |
| Claude Fable 5.1 | $10.00 | $50.00 | $0.25 | $1.245 |
| GPT-6 Astra | $10.00 | $50.00 | $1.00 | $1.380 |
在 Artificial Analysis Intelligence Index v4.3.2 上实测的每任务成本(读取于 2026 年 9 月 22 日,按得分排序)。47.5 分以内,GPT-6 Sol 是最便宜的选择。高于此分数,Opus 5.5 在每个档位都最便宜:Opus 5.5 high 以 1.82 美元拿到 53.6 分,而 GPT-6 Astra max 以 3.26 美元拿到 52.7 分,Fable 5.1 max 以 7.63 美元拿到 53.4 分。
| 模型 | Intelligence Index | 每任务成本 | 每任务输出 token |
|---|---|---|---|
| GPT-6 Sol · medium | 39.8 | $0.25 | 6,500 |
| GPT-6 Sol · xhigh | 44.1 | $0.53 | 16,000 |
| GPT-6 Astra · low | 45.8 | $0.82 | 4,400 |
| GPT-6 Sol · max | 47.5 | $1.06 | 31,200 |
| Claude Opus 5 · high | 48.1 | $3.61 | 46,200 |
| Claude Opus 5 · max | 50.8 | $5.86 | 72,500 |
| Claude Opus 5.5 · medium | 51.2 | $1.34 | 25,700 |
| Claude Fable 5.1 · high | 51.2 | $3.91 | 38,100 |
| GPT-6 Astra · max | 52.7 | $3.26 | 27,200 |
| Claude Fable 5.1 · max | 53.4 | $7.63 | 78,100 |
| Claude Opus 5.5 · high | 53.6 | $1.82 | 35,600 |
| Claude Opus 5.5 · max | 57.6 | $5.98 | 119,200 |
GPT-6 Astra 高于 low 的所有设置、Opus 5 的所有设置以及 Fable 5.1 的所有设置,都比得分相同或更高的 Sol 或 Opus 5.5 设置更贵。每任务成本取决于基准测试的任务构成。切换模型前请用自己的流量回放验证。
它足以取代 Fable 吗?
Anthropic 将 Opus 5.5 定位为在大多数任务上与 Fable 5.1 匹配。已发布的数字支持编码和代理工作:
- Terminal-Bench 4.0: 66.4%,相比 Opus 5 52.3% 和 Fable 5.1 55.8%。
- FrontierCode v1.1: 54.4%,相比 Opus 5 48.0% 和 Fable 5.1 50.3%。
- CursorBench 4.0: 57.8%,相比 Opus 5 46.6%。
- GDPval-AA v2.1: 1846 Elo,相比 Opus 5 1708。
Artificial Analysis 在发布当天在其 Intelligence Index 上排名第一。Anthropic 还表示,在默认(中等)努力下,它在知识工作中击败每项任务成本约五分之一的 GPT-6 Astra 最大努力。这是供应商比较,因此请将其视为要测试的假设。上面的成本数学是您可以自己验证的部分。
快速模式成本 2×
快速模式成本 $8 输入和 $40 输出,恰好是标准费率的两倍,速度最高可达 2.5×。标准模型也比 Opus 5 快约 30%。对于延迟受限的交互式路径,其中用户正在等待时,使用快速模式。将其从批处理作业、后台代理和评估中保留。启用快速模式作为默认时,单位成本翻倍,仪表板在发票到达之前显示任何异常。
本周做什么
- 固定模型 ID。 将生产明确指向
claude-opus-5-5并在每个请求上记录 ID,以便迁移后可按模型拆分每个请求的成本。 - 在您自己的流量上重新基线。 在两个模型上重放实际请求的样本,并比较每个完成任务的令牌,而不是每个调用。20% 令牌效率声称是最可能因工作负载而异的部分。
- 重新检查努力设置。 如果工作负载转移到 Fable 或最大努力以获得质量,请先在中等级别测试 Opus 5.5。这是 Anthropic 基准测试的设置。
- 重新运行 Fable 路由决定。 任何将缓存繁重流量发送到 Fable 以获得更便宜缓存读取的路由都应重新评估。该成本优势消失了。
- 监视缓存命中率。 在 $4.00 的 $0.20 处,缓存未命中现在花费命中的 20 倍。打破前缀的提示模板更改比在 Opus 5 上花费的成本更高。
Anthropic 表示 Sonnet 5.5 和 Haiku 5.5 将在接下来的几周内推出。从第 2 步保持重放线束,以便可在午后重新基线每个发布。
Related
Want this applied to your own LLM spend? FinOps LLM runs a free audit of your AI costs and shows where the savings are. Book free audit →