Claude Fable 5.1 与 Opus 5.5:我们 Claude Code 日志中的真实价格倍数
更新于 October 10, 2026 · 首次发布 October 10, 2026
Claude Fable 5.1 的标价为每百万 $10 输入、$50 输出。Opus 5.5 的标价为 $4 和 $20。这就是大家都在引用的 2.5 倍。标题上的数字没错,但账单上是错的:智能体消耗大部分 Token 的缓存读取,只有 1.25 倍。我们对四整周自己的 Claude Code 日志中每一轮 Fable 和 Opus 5.5 都做了定价,以看清溢价的真实水平。
- 按我们真实的 Token 组合定价:Opus 风格的轮次为 2.13 倍,Fable 自身的轮次为 2.31 倍。不是 2.5 倍。
- 按实际运行计算的每轮成本:一轮 Fable 5.1 花费 $0.284,一轮 Opus 5.5 花费 $0.064。即4.4 倍,因为在默认的高强度下,Fable 每轮输出的内容多约 2.7 倍。
- 编码基准测试偏向 Opus 5.5:Anthropic 自己的 Terminal-Bench 4.0 数据显示,Opus 5.5 为 66.4%,Fable 5.1 为 55.8%。Snorkel 的独立测试结果为 64.8% 对 57.9%,且 Fable 的那次运行成本高 1.3 倍。
- 推理基准测试偏向 Fable:Artificial Analysis 在最大强度下给 Fable 5.1 的智能指数打了 66 分,是 Claude 中的最高分。
- 在 Max 套餐上:Fable 可以占用你每周限额的一半,并且消耗得更快。我们把它控制在每周用量的 0% 至 10%。
Anthropic 的声明是什么
以下是厂商的声明,按已发布的内容或发布报道引用。我们的测量结果在后面。
| 声明 | 来源 |
|---|---|
| Fable 5.1 每百万 Token 标价:输入 $10,输出 $50,缓存读取 $0.25,5 分钟缓存写入 $12.50,1 小时缓存写入 $20。 | API 定价页面 |
| Opus 5.5 每百万 Token 标价:输入 $4,输出 $20,缓存读取 $0.20,5 分钟缓存写入 $5,1 小时缓存写入 $8。 | API 定价页面 |
| 对于典型工作负载,Fable 5.1 比 Fable 5 便宜约 25%;对于智能体工作负载,最多便宜约 45%,主要因为缓存读取价格从 $1.00 降至 $0.25。 | 发布报道(Constellation Research、NYU Shanghai RITS) |
| Opus 5.5 的表现接近 Fable 5.1,并且在默认强度下,以约五分之一的成本超过了最大强度下的 Opus 5。 | Opus 5.5 发布文章 |
| Terminal-Bench 4.0:Opus 5.5 在 xhigh 强度下为 66.4%,Fable 5.1 为 55.8%。 | Opus 5.5 发布文章 |
| Fable 5.1 在 Humanity's Last Exam 上不使用工具得分 60.9%,使用工具得分 65.0%。高强度是其默认设置。 | 发布报道 |
| 在 Max 套餐上,Fable 模型可以占用你每周限额的最多 50%,拥有自己的每周限额,并且比其他模型更快地消耗限额。在 Pro 上,Fable 使用按量付费的用量积分运行。 | Claude Fable 模型在你的套餐中 |
| Claude Code 在付费套餐上默认使用 Opus 5.5。Fable 从不作为默认值,需要你通过 /model 选择。 | Claude Code 模型配置文档 |
Anthropic 没有公布的是:Fable 消耗套餐限额的速度有多快。套餐页面只说“更快”,别无其他。
为什么真实倍数是 2.1 至 2.3 倍,而不是 2.5 倍
Claude Code 的一轮智能体对话,会从缓存中重新读取整个对话,然后写入少量新的输出。在我们 22,411 轮 Opus 5.5 中,平均每轮读取约 94,000 个缓存 Token,写入约 551 个输出 Token。缓存读取每个 Token 比输出便宜 100 倍,但数量多出 170 倍,因此它们在账单中占有真实的分量。五种 Token 类型,五种价格:
| Token 类型,每百万 | Opus 5.5 | Fable 5.1 | 倍数 |
|---|---|---|---|
| 输入 | $4.00 | $10.00 | 2.5 倍 |
| 输出 | $20.00 | $50.00 | 2.5 倍 |
| 缓存写入,5 分钟 | $5.00 | $12.50 | 2.5 倍 |
| 缓存写入,1 小时 | $8.00 | $20.00 | 2.5 倍 |
| 缓存读取 | $0.20 | $0.25 | 1.25 倍 |
把我们 Opus 5.5 轮次的确切 Token 按 Fable 价格重新计算,账单从 $1,436 升至 $3,061:2.13 倍。反过来对我们的 Fable 轮次做计算,得到2.31 倍;Fable 的轮次更多依赖输出和 1 小时缓存写入,因此其账单中享受缓存读取折扣的部分更少。你的智能体越依赖缓存,倍数就越低于 2.5 倍。纯聊天、没有缓存的工作负载则正好是完整的 2.5 倍。
每轮是 4.4 倍,而价格只占其中一半
| 每轮,我们的日志 | Opus 5.5 | Fable 5.1 |
|---|---|---|
| 轮次 | 22,411 | 486 |
| 每轮输出 Token | 551 | 1,461 |
| 每轮缓存读取 Token | 约 94,000 | 约 94,000 |
| 每轮 1 小时缓存写入 Token | 3,939 | 9,383 |
| 按各自标价计算的每轮成本 | $0.064 | $0.284 |
| 四周合计 | $1,436 | $138 |
两者的上下文大小相同,都约为每轮 94,000 个缓存 Token。不同的是行为。Fable 每轮多写出 2.7 倍的输出,每轮新写入的缓存多 2.4 倍。这是 Fable 的默认设置高强度,即每一步做更多的思考。价格解释了约 2.3 倍,行为解释了其余部分,合计每轮 4.4 倍。
一个坦率的说明:我们是为较难的轮次选择了 Fable。其中一部分额外的输出是任务本身的需要,而不完全是模型的问题。即便如此,每轮的差距仍是你的账单所看到的数字。
原始数据:fable-5-1-vs-opus-5-5-turns.csv。
额外的钱买到了什么
| 基准测试 | Opus 5.5 | Fable 5.1 | 测试方 |
|---|---|---|---|
| Terminal-Bench 4.0 | 66.4%(xhigh) | 55.8% | Anthropic |
| Terminal-Bench 4.0,得分 | 64.8% | 57.9% | Snorkel,独立 |
| Terminal-Bench 4.0,运行成本 | $4.7k,8.0B Token | $6.2k,2.7B Token | Snorkel,独立 |
| 智能指数,每任务成本 | 不在同一页面上 | max 强度下 66 分,$3.76;xhigh 强度下 65 分,$2.72 | Artificial Analysis |
在智能体编码方面,Opus 5.5 在得分和成本上都胜出。Snorkel 的运行结果反过来印证了我们日志中的规律:Fable 只用了三分之一的 Token,成本却仍高出 1.3 倍,因为它的每个 Token 定价更高。在 Artificial Analysis 的通用推理指数上,最大强度下的 Fable 5.1 是 Claude 的最高分,领先于最大强度下的 Opus 5(63 分,每任务 $2.34)。Artificial Analysis 将 Opus 5.5 单独列出,在中等到 xhigh 强度下得分 51 至 56,每任务 $1.34 至 $3.46。我们还没有在同一个对比页面上看到这些数据,因此请把这个差距仅视为参考。
这对 Claude Max 的一周意味着什么
我们每周都会用满 Claude Max 5x 的每周上限。按当前标价计算(将 Opus 5 和 Sonnet 5 的轮次按 Opus 5.5 和 Sonnet 5.5 重新计价),这四周的用量价值分别为 $419、$761、$873 和 $658。其中 Fable 的份额分别为 $39、$34、$0 和 $65:即每周的 9.3%、4.5%、0% 和 9.9%。Anthropic 允许 Fable 占用最多 50% 的每周限额,并称其消耗限额更快,但没有说快多少。如果套餐的计量接近标价,那么每一轮 Fable 大约消耗四轮 Opus 5.5 的配额。如果你把一半的一周用在 Fable 上,你原本能拿到的轮次就会损失约 40%。
什么时候 Fable 5.1 值得 2.5 倍
- 编码智能体默认用 Opus 5.5。它在 Terminal-Bench 上领先 7 至 11 分,每轮成本约为其四分之一。Claude Code 已经默认使用它。
- 一次性的困难推理才切换到 Fable:一个架构决策、一个棘手的根因分析、一次规格评审。轮次少、风险高,并且它在推理基准测试上领先。
- 在 API 上,缓存缩小了差距。一个长上下文、缓存命中率高的智能体,支付的倍数约为 2.1 倍,而不是 2.5 倍。降低强度会进一步缩小差距。
- 在 Max 套餐上,要设上限。像我们一样,把 Fable 控制在一周的约 10%。超过这个比例,它就会吞掉你为 Opus 留出的轮次。
关于与 Codex 的完整套餐对比,参见 2026 年 10 月的 Claude 与 Codex。关于 Fable 定价背后的缓存命中率计算,参见 Fable 5.1 成本模型。
这不能说明什么
这是一位重度用户的日志。Fable 运行了 486 轮,而 Opus 5.5 为 22,411 轮,而且我们为更难的轮次选择了 Fable,因此它的每轮成本存在向上偏差。美元数字是按 API 标价计算的价值,而不是我们在固定套餐上实际支付的金额。部分 Fable 的数字来自引用 Anthropic 的发布报道,因为我们没能找到 Anthropic 自己的 Fable 5.1 发布文章。价格与 Anthropic 的定价页面一致。
来源
- Anthropic API 定价
- Anthropic:推出 Claude Opus 5.5
- Anthropic:Claude Fable 模型在你的套餐中
- Anthropic:在 Pro 或 Max 套餐中使用 Claude Code
- Claude Code:模型配置
- Constellation Research:Claude Fable 5.1 发布
- NYU Shanghai RITS:Fable 5.1 缓存读取降价
- Artificial Analysis:Claude Fable 5.1
- Snorkel:Terminal-Bench 4.0 排行榜
相关文章
- 2026 年 10 月的 Claude 与 Codex
- Claude Fable 5.1 成本模型
- Claude Opus 5.5 成本模型
- Opus 5.5 思考强度成本
- Claude Max 20x 与 5x 每周限额
想将这些方法用于您的技术栈吗? 请准备好供应商账单、网关日志和主要工作流;我们会梳理成本驱动因素与节省空间。 预约免费审查 →