2026 年 10 月编码选 Claude Max 还是 ChatGPT Pro?我们按日志逐项算了账
更新于 October 10, 2026 · 首次发布 October 10, 2026
同样是每月 $100,两笔交易差别很大。我们按 API 标价,用自己的日志为 Claude Max 5x 计划的每一轮 Claude Code 对话,以及 ChatGPT Pro $100 计划的每一次 Codex 请求定价。本月两边的价格都有变动,因此下面每个数字都按今日标价计算,旁边标注了当时的价格。我们每周都用满 Claude 的周限额。在三个可比的周里,一个完整的周限额价值 $658 到 $873 的 API 用量,中位数为 $761。一个完整的 Codex 窗口中位数价值 $179。Claude 看起来大了 4 倍。但按工作内容计价后,Claude 仍然领先,只是优势小得多。
- 每个完整周的 API 原始价值(今日标价):Claude Max 5x 为 $658 到 $873,中位数 $761。Codex Pro $100 中位数 $179。
- 每 token 价格:GPT-6.1 Sol 的标价恰好是 Opus 5.5 的一半:输入 $2 对 $4,输出 $10 对 $20。
- 每项任务成本:Opus 5.5 完成一个基准任务花了 $0.87,GPT-6 Sol 完成同一任务只花了 $0.26。在 Terminal-Bench 4.0 上,使用 Opus 5.5 的 Claude Code 整轮花费约为使用 GPT-6.1 Sol 的 Codex 的 8 倍。
- 每周任务数:Claude 约 756 到 1,003 个(中位数 875),Codex 约 688 个。Claude 领先约 27%。
- 两边各自的陷阱:Claude 的周限额每周都是上限,外加一个 5 小时限额,会让长会话卡住。Codex Pro 没有 5 小时限额,而重置可能让一周的额度成倍增加。
10 月发生了什么变化
我们上次做这项比较时,Claude 这边看起来无人能敌:按 API 价格,一个 Max 5x 周值 $1,217 或更多。此后有三件事变了。
- Anthropic 降低了 Claude 的每 token 价格,因此同样的配额值更少的美元。Opus 5.5 标价为每百万 token 输入 $4、输出 $20,而 Opus 5 为 $5 和 $25。其缓存读取从 $0.50 降到 $0.20,而重度智能体会话主要就是缓存读取。
- 周促销结束了。从 9 月 14 日起,Claude Code 周限额永久提高 25%,取代了临时的 50% 加成。这比加成后的水平低约 17%。
- OpenAI 降价,随后又下调了 Pro $200。GPT-6.1 Sol 于 9 月 29 日上线,缓存输入价格减半至 $0.10。从 10 月 30 日起,ChatGPT Pro $200 在 Codex 中的倍数从 Plus 的 20 倍降到 10 倍。现有订阅者可在 10 月 29 日前保持当前限额,并获得一次性 $2,500 积分,年底到期。新的 Pro $500 档是唯一带 Ultrafast 的档位,其倍数未公布。
厂商怎么说
在我们的数字之前,先看看每家厂商对你能拿到什么的说法。这些是它们的宣称,不是我们的测量。
| 厂商 | 宣称 | 来源 |
|---|---|---|
| Anthropic | Opus 5.5 标价为每百万 token 输入 $4、缓存读取 $0.20、输出 $20。Fable 5.1 标价为 $10、$0.25 和 $50,输入与输出都是其 2.5 倍。 | API 定价页面 |
| Anthropic | Opus 5.5 的表现接近 Fable 5.1,并且在默认 effort 下,以约五分之一的成本超过 max effort 的 Opus 5。 | Opus 5.5 发布文章 |
| Anthropic | Opus 5.5 在 xhigh effort 下于 Terminal-Bench 4.0 得分 66.4%,而 GPT-6 Astra 为 57.9%,Fable 5.1 为 55.8%。 | Opus 5.5 发布文章 |
| Anthropic | Max 5x 是“Pro 套餐每会话用量的五倍”。未公布每周数字。 | Max 套餐帮助页面 |
| Anthropic | 从 9 月 14 日起,Claude Code 周限额提高 25%,在 50% 促销之后“使其中一部分永久化”。 | 周限额促销页面 |
| Anthropic | 在 Max 上,Fable 最多可占用你周限额的 50%,并且消耗速度快于其他模型。 | Fable 在你的套餐上的帮助页面 |
| OpenAI | GPT-6.1 Sol 标价为输入 $2、缓存 $0.10、输出 $10,在智能体编码上几乎与 GPT-6 Astra 持平,而 token 价格只有 Astra 的五分之一。 | DevDay 发布,经 Mixed News 与 AI Catchup 报道 |
| OpenAI | Pro 套餐没有五小时限额。Plus 每 5 小时估计可完成 15 到 160 个 GPT-6.1 Sol Codex 任务。“周限额也可能适用。” | Codex 定价页面 |
| OpenAI | Pro $200 将于 10 月 30 日从 Plus 的 20 倍降至 10 倍,价格不变。 | 引用 OpenAI 的行业媒体报道 |
注意两者都没有公布的内容:一个周限额究竟能容纳多少用量。Anthropic 给出的是每会话倍数,OpenAI 给出的任务范围宽至 10 倍。这就是我们要用自己的日志来定价的原因。
我们如何让各周可比
Claude 的四个周和 Codex 的七个窗口并非在相同价格或相同上限下运行。若按原价计算,最早的周看起来最大,因为同样的 token 当时更贵。我们对三件事做了修正:
- 模型价格。每一轮 Opus 5、Sonnet 5 和 Fable 5 对话都按 Opus 5.5、Sonnet 5.5 和 Fable 5.1 的标价重新计价。每个 GPT-6 Sol 请求都按 GPT-6.1 Sol 重新计价。两边影响最大的是缓存读取价格:Opus 从 $0.50 降到 $0.20,Sol 从 $0.20 降到 $0.10。
- 上限大小。9 月 11 日那一个 Claude 周在 9 月 14 日前运行于临时的 +50% 促销之下,之后才是永久的 +25%。它与之后各周的上限不同,因此我们展示它,但不计入区间和中位数。
- 部分窗口。两个 Codex 窗口分别用到上限的 98% 和 99%。我们将其按比例放大到 100%。一个在 14% 就停止的窗口被排除。
重新计价大大改变了 Claude 的数字,但对总结论影响很小:未调整时,四个周分别为 $644、$953、$874 和 $658。9 月 18 日那一周从 $953 降到 $761,因为其中一半是 Opus 5 的用量。在 Codex 方面,中位数从当日价格下的 $237 变为今日的 $179。
Claude 这边:每一周都是满额上限
我们使用 Max 5x,并且每周都把它用到周限额。有些周我们用到 100% 就停下来等待重置;有一周客户端在重置前 16 分钟就显示了限额提示。无论哪种情况,下表的每一行都是一个完整的周限额。我们的日志从 9 月 11 日重新开始(旧日志已被保留策略清理),因此我们为四个完整窗口定价。窗口从周五 14:00 UTC 开始,即 Claude Code 报告的重置时间。
| 周开始 | 当时价格 | 今日价格 | 轮次 | 主要模型 | 上限 |
|---|---|---|---|---|---|
| 9 月 11 日 | $644 | $419 | 6,844 | Opus 5 | 100%,促销上限至 9 月 14 日(不可比) |
| 9 月 18 日 | $953 | $761 | 13,474 | Opus 5, Opus 5.5 | 100% |
| 9 月 25 日 | $874 | $873 | 23,337 | Opus 5.5, Sonnet 5.5 | 100% |
| 10 月 2 日 | $658 | $658 | 12,489 | Opus 5.5, Sonnet 5.5, Fable 5.1 | 100% |
因此,按今日价格,一个完整的 Max 5x 周值 $658 到 $873 的 API 价值,中位数 $761。上限每周都相同,但美元价值不同。差异来自上限被花在了什么上。Claude.ai 聊天共用同一个池,但不在 Claude Code 日志中,因此聊天占比高的一周折算出的价值更低。Fable 5.1 的标价是 Opus 5.5 的 2.5 倍,而且按 Anthropic 的说法,它更快地消耗限额,因此它占上限的权重并不等于其美元占比。我们在单独一篇关于 Fable 5.1 与 Opus 5.5 的文章中讨论了这一点。
另外,在 9 月 10 日至 10 月 9 日期间,我们触发了滚动 5 小时会话限额 17 次。这才是 Claude 日常真正的摩擦:长会话在任务中途卡住,你只能等待。
原始数据:claude-max-5x-weekly-windows.csv。
Codex 这边:窗口更小,但工作更便宜
Pro $100 的七个完整 Codex 窗口,时间从 9 月 27 日到 10 月 15 日。起始日期重叠的是重置:重置会在旧窗口耗尽前开启一个新窗口。
| 窗口 | 当时价格 | 今日价格 | 已用上限 | 主要模型 |
|---|---|---|---|---|
| 09/27 至 10/04 | $277 | $178 | 100% | GPT-6 Sol |
| 09/27 至 10/04 | $263 | $167 | 100% | GPT-6 Sol |
| 09/28 至 10/05 | $278 | $179 | 100% | GPT-6 Sol |
| 09/30 至 10/07 | $137 | $103 | 100% | GPT-6 Sol, GPT-6.1 Sol |
| 10/02 至 10/09 | $186 | $182 | 98% | GPT-6.1 Sol, GPT-6 Luna |
| 10/07 至 10/14 | $237 | $237 | 100% | GPT-6.1 Sol, GPT-6 Luna |
| 10/08 至 10/15 | $229 | $229 | 99% | GPT-6.1 Sol, GPT-6 Luna |
按今日价格,每个窗口为 $103 到 $237,中位数 $179,不到一个 $67 的 Plus 周的 3 倍,而非宣传的 5 倍(完整拆解见此)。原始数据:codex-pro-100-windows-repriced.csv。但 Codex 用更少的美元完成同样的工作:
| 测试 | Claude | Codex | 差距 |
|---|---|---|---|
| API 标价,每百万 token | Opus 5.5:$4 输入 / $20 输出 | GPT-6.1 Sol:$2 输入 / $10 输出 | 2x |
| DataCamp:同一个 Tetris 构建,API 成本 | Opus 5.5:$0.87 | GPT-6 Sol:$0.26 | 3.3x |
| codeongrass:同一个插件功能,token 数 | Claude Code:6.2M | Codex:1.5M | 4.2x |
| Snorkel Terminal-Bench 4.0,完整 66 个任务运行成本 | Claude Code + Opus 5.5:$4.7k,8.0B token | Codex + GPT-6.1 Sol:$0.6k,1.5B token | 约 8x |
| Snorkel Terminal-Bench 4.0,得分(max effort) | Opus 5.5:64.8% | GPT-6.1 Sol:58.2% | Claude 领先 6.6 个点 |
Snorkel 的排行榜是我们找到的唯一一个让每个模型都运行在其本厂商智能体中(Claude Code 与 Codex)的榜单,这也是订阅所对应的使用方式。Anthropic 自己公布的 Opus 5.5 Terminal-Bench 成绩为 66.4%;OpenAI 尚未公布 GPT-6.1 Sol 的该项成绩,而是报告了 DeepSWE(75.2%)。我们下面的每任务计算采用 DataCamp 的 3.3 倍差距,这是保守的一端:Snorkel 的运行表明在 max effort 下差距更大。DataCamp 的 $0.26 是在 GPT-6 Sol 上测得的,早于缓存价格减半,所以在 GPT-6.1 Sol 上,Codex 的任务可能比我们假设的还要便宜一点。
Pro 套餐也没有 5 小时限额,而 Codex 有重置。在 12 天内,我们得到了八个窗口而非两个,价值为 $1,211 的 API 价值。重置不是你能提前规划的东西,因此我们没有把它计入下面的基线。
同样的钱买到更多:每周任务数
当同一项工作一个模型需要 3 倍的 token 时,API 美元价值就是错误的单位。用每个套餐的周价值除以其每任务成本:
| 套餐 | 月费 | 每周 API 价值 | 每周任务数 |
|---|---|---|---|
| ChatGPT Plus | $20 | $67 | 约 258 |
| Claude Max 5x | $100 | $658 到 $873(中位数 $761) | 约 756 到 1,003(中位数 875) |
| ChatGPT Pro $100 | $100 | $179 | 约 688 |
| ChatGPT Pro $200,10 月 29 日前 | $200 | 20x 标注 | 约 5,154(先前研究) |
| ChatGPT Pro $200,10 月 30 日起(标注) | $200 | $670 | 约 2,577 |
| ChatGPT Pro $200,10 月 30 日起(我们的比率) | $200 | 约 $358 | 约 1,377 |
这里的一个任务指一个基准规模的编码工作。你的任务会更大或更小,但只要 3.3 倍的成本差距成立,这些比率就成立。
2026 年 10 月的结论
- 每月 $20:选 ChatGPT Plus。每周 258 个任务,是榜单上最高的单位性价比。我们没有测量 Claude Pro,但其周池只有 Max 5x 的五分之一。
- 每月 $100:Claude Max 5x,任务数领先约 27%,若你在 max effort 下工作,领先会更少。它完成的任务更多,并且在困难、模糊的问题上胜出。Codex Pro $100 不会因为 5 小时限额而卡住,而一次重置就可能让一周的额度翻三倍。如果你的工作是一连串定义清晰的工单,选 Codex。如果是棘手的调试和设计,选 Claude。
- 每月 $120:我们的选择是 Claude Max 5x 加 ChatGPT Plus。把困难的思考交给 Opus,把大量的工作交给 Codex,你就很少会撞上任何一堵墙。
- 每月 $200:在 10 月 29 日前,ChatGPT Pro $200 显然是大量任务的赢家。10 月 30 日起,按我们测得的比率,它会接近 Claude Max 20x。如果你已经订阅,请在此之前领取 $2,500 积分。
这项研究不能说明什么
这是一位重度用户的日志,而非样本小组。9 月 11 日之前的 Claude 日志已被清理,因此我们无法重新核对支撑我们早先 $1,217 数字的 8 月各周。Claude.ai 聊天与周池共用,但不在日志中,因此仅在 Claude Code 中用满的一个上限,很可能比 $658 的低端更有价值。重新定价假设模型变化时套餐上限没有改变;两家厂商都没有说明更便宜的模型是否也会拉长上限。数百个使用较旧 gpt-5.5 模型的 Codex 请求没有公布价格,因此被排除。$67 的 Plus 周是更早测得的,未重新计价。GPT-6.1 Sol 的厂商宣称来自引用 OpenAI 的发布报道,因为 OpenAI 自己的文章屏蔽了自动化读取器;我们核对的所有来源中 $2 和 $10 的价格一致。美元数字是按标价计算的 API 等值价值,而非我们实际支付的钱。两家厂商都以各自的单位计量,且都没有公布换算方式。
来源
- Anthropic API 定价
- Anthropic:什么是 Max 套餐
- OpenAI:Codex 套餐与用量限额
- The Next Web:OpenAI 削减 Pro $200 用量,新增 Pro $500
- OpenAI 帮助中心:Codex 已储存的重置
- DataCamp:GPT-6 Sol 对比 Claude Opus 5.5
- codeongrass:重度用户的 Claude Code 对比 Codex
- Snorkel:Terminal-Bench 4.0 排行榜
- Anthropic:Introducing Claude Opus 5.5
- Anthropic:Claude Fable 模型在你的套餐中
- Anthropic:Claude Code 周限额促销
- Mixed News:GPT-6.1 Sol 定价
- AI Catchup:GPT-6.1 Sol 发布、定价与基准
- OpenAI:Introducing GPT-6.1 Sol
相关文章
- Fable 5.1 与 Opus 5.5:2.5 倍值不值?
- Claude Max 20x 与 ChatGPT Pro 对比
- ChatGPT Pro $100 实际是 Plus 的 2.6 倍
- OpenAI 削减了 ChatGPT Pro $200
- Codex 重置让 $40 变成 $1,211
- Claude Max 20x 与 5x 周限额对比
- Claude Opus 5.5 成本模型
想将这些方法用于您的技术栈吗? 请准备好供应商账单、网关日志和主要工作流;我们会梳理成本驱动因素与节省空间。 预约免费审查 →