跳至正文

Claude Fable 5.1 与 Opus 5.5:我们 Claude Code 日志中的真实价格倍数

更新于 October 10, 2026 · 首次发布 October 10, 2026

快速结论: Claude Fable 5.1 的标价为每百万 $10 输入、$50 输出。Opus 5.5 的标价为 $4 和 $20。这就是大家都在引用的 2.5 倍。标题上的数字没错,但账单上是错的:智能体消耗大部分 Token 的缓存读取,只有 1.25 倍。我们对四整周自己的 Claude Code 日志中每一轮 Fable 和 Opus 5.5 都做了定价,以看清溢价的真实水平。 按我们真实的...

Claude Fable 5.1 的标价为每百万 $10 输入、$50 输出。Opus 5.5 的标价为 $4 和 $20。这就是大家都在引用的 2.5 倍。标题上的数字没错,但账单上是错的:智能体消耗大部分 Token 的缓存读取,只有 1.25 倍。我们对四整周自己的 Claude Code 日志中每一轮 Fable 和 Opus 5.5 都做了定价,以看清溢价的真实水平。

Fable 5.1 相对 Opus 5.5 的价格倍数,按 Token 类型及我们的真实轮次0x0.5x1x1.5x2x2.5x3x2.5x输入2.5x输出2.5x缓存写入1.25x缓存读取2.13x我们的 Opus 轮次2.31x我们的 Fable 轮次
Fable 5.1 相对 Opus 5.5 的价格倍数,按 Token 类型及我们的真实轮次

Anthropic 的声明是什么

以下是厂商的声明,按已发布的内容或发布报道引用。我们的测量结果在后面。

声明来源
Fable 5.1 每百万 Token 标价:输入 $10,输出 $50,缓存读取 $0.25,5 分钟缓存写入 $12.50,1 小时缓存写入 $20。API 定价页面
Opus 5.5 每百万 Token 标价:输入 $4,输出 $20,缓存读取 $0.20,5 分钟缓存写入 $5,1 小时缓存写入 $8。API 定价页面
对于典型工作负载,Fable 5.1 比 Fable 5 便宜约 25%;对于智能体工作负载,最多便宜约 45%,主要因为缓存读取价格从 $1.00 降至 $0.25。发布报道(Constellation Research、NYU Shanghai RITS)
Opus 5.5 的表现接近 Fable 5.1,并且在默认强度下,以约五分之一的成本超过了最大强度下的 Opus 5。Opus 5.5 发布文章
Terminal-Bench 4.0:Opus 5.5 在 xhigh 强度下为 66.4%,Fable 5.1 为 55.8%。Opus 5.5 发布文章
Fable 5.1 在 Humanity's Last Exam 上不使用工具得分 60.9%,使用工具得分 65.0%。高强度是其默认设置。发布报道
在 Max 套餐上,Fable 模型可以占用你每周限额的最多 50%,拥有自己的每周限额,并且比其他模型更快地消耗限额。在 Pro 上,Fable 使用按量付费的用量积分运行。Claude Fable 模型在你的套餐中
Claude Code 在付费套餐上默认使用 Opus 5.5。Fable 从不作为默认值,需要你通过 /model 选择。Claude Code 模型配置文档

Anthropic 没有公布的是:Fable 消耗套餐限额的速度有多快。套餐页面只说“更快”,别无其他。

为什么真实倍数是 2.1 至 2.3 倍,而不是 2.5 倍

Claude Code 的一轮智能体对话,会从缓存中重新读取整个对话,然后写入少量新的输出。在我们 22,411 轮 Opus 5.5 中,平均每轮读取约 94,000 个缓存 Token,写入约 551 个输出 Token。缓存读取每个 Token 比输出便宜 100 倍,但数量多出 170 倍,因此它们在账单中占有真实的分量。五种 Token 类型,五种价格:

Token 类型,每百万Opus 5.5Fable 5.1倍数
输入$4.00$10.002.5 倍
输出$20.00$50.002.5 倍
缓存写入,5 分钟$5.00$12.502.5 倍
缓存写入,1 小时$8.00$20.002.5 倍
缓存读取$0.20$0.251.25 倍

把我们 Opus 5.5 轮次的确切 Token 按 Fable 价格重新计算,账单从 $1,436 升至 $3,061:2.13 倍。反过来对我们的 Fable 轮次做计算,得到2.31 倍;Fable 的轮次更多依赖输出和 1 小时缓存写入,因此其账单中享受缓存读取折扣的部分更少。你的智能体越依赖缓存,倍数就越低于 2.5 倍。纯聊天、没有缓存的工作负载则正好是完整的 2.5 倍。

每轮是 4.4 倍,而价格只占其中一半

我们日志中 Claude Code 一轮的平均成本,2026 年 9 月 11 日至 10 月 9 日$0.00$0.05$0.10$0.15$0.20$0.25$0.30$0.064Opus 5.5 轮次$0.137同一轮在 Fable 上$0.123Fable 轮次按 Opus 价格$0.284Fable 5.1 轮次
我们日志中 Claude Code 一轮的平均成本,2026 年 9 月 11 日至 10 月 9 日
每轮,我们的日志Opus 5.5Fable 5.1
轮次22,411486
每轮输出 Token5511,461
每轮缓存读取 Token约 94,000约 94,000
每轮 1 小时缓存写入 Token3,9399,383
按各自标价计算的每轮成本$0.064$0.284
四周合计$1,436$138

两者的上下文大小相同,都约为每轮 94,000 个缓存 Token。不同的是行为。Fable 每轮多写出 2.7 倍的输出,每轮新写入的缓存多 2.4 倍。这是 Fable 的默认设置高强度,即每一步做更多的思考。价格解释了约 2.3 倍,行为解释了其余部分,合计每轮 4.4 倍。

一个坦率的说明:我们是为较难的轮次选择了 Fable。其中一部分额外的输出是任务本身的需要,而不完全是模型的问题。即便如此,每轮的差距仍是你的账单所看到的数字。

原始数据:fable-5-1-vs-opus-5-5-turns.csv。

额外的钱买到了什么

基准测试Opus 5.5Fable 5.1测试方
Terminal-Bench 4.066.4%(xhigh)55.8%Anthropic
Terminal-Bench 4.0,得分64.8%57.9%Snorkel,独立
Terminal-Bench 4.0,运行成本$4.7k,8.0B Token$6.2k,2.7B TokenSnorkel,独立
智能指数,每任务成本不在同一页面上max 强度下 66 分,$3.76;xhigh 强度下 65 分,$2.72Artificial Analysis

在智能体编码方面,Opus 5.5 在得分和成本上都胜出。Snorkel 的运行结果反过来印证了我们日志中的规律:Fable 只用了三分之一的 Token,成本却仍高出 1.3 倍,因为它的每个 Token 定价更高。在 Artificial Analysis 的通用推理指数上,最大强度下的 Fable 5.1 是 Claude 的最高分,领先于最大强度下的 Opus 5(63 分,每任务 $2.34)。Artificial Analysis 将 Opus 5.5 单独列出,在中等到 xhigh 强度下得分 51 至 56,每任务 $1.34 至 $3.46。我们还没有在同一个对比页面上看到这些数据,因此请把这个差距仅视为参考。

这对 Claude Max 的一周意味着什么

我们每周都会用满 Claude Max 5x 的每周上限。按当前标价计算(将 Opus 5 和 Sonnet 5 的轮次按 Opus 5.5 和 Sonnet 5.5 重新计价),这四周的用量价值分别为 $419、$761、$873 和 $658。其中 Fable 的份额分别为 $39、$34、$0 和 $65:即每周的 9.3%、4.5%、0% 和 9.9%。Anthropic 允许 Fable 占用最多 50% 的每周限额,并称其消耗限额更快,但没有说快多少。如果套餐的计量接近标价,那么每一轮 Fable 大约消耗四轮 Opus 5.5 的配额。如果你把一半的一周用在 Fable 上,你原本能拿到的轮次就会损失约 40%。

什么时候 Fable 5.1 值得 2.5 倍

关于与 Codex 的完整套餐对比,参见 2026 年 10 月的 Claude 与 Codex。关于 Fable 定价背后的缓存命中率计算,参见 Fable 5.1 成本模型。

这不能说明什么

这是一位重度用户的日志。Fable 运行了 486 轮,而 Opus 5.5 为 22,411 轮,而且我们为更难的轮次选择了 Fable,因此它的每轮成本存在向上偏差。美元数字是按 API 标价计算的价值,而不是我们在固定套餐上实际支付的金额。部分 Fable 的数字来自引用 Anthropic 的发布报道,因为我们没能找到 Anthropic 自己的 Fable 5.1 发布文章。价格与 Anthropic 的定价页面一致。

来源

相关文章


想将这些方法用于您的技术栈吗? 请准备好供应商账单、网关日志和主要工作流;我们会梳理成本驱动因素与节省空间。 预约免费审查 →

返回 finopsllm.com