跳至正文

2026 年 10 月编码选 Claude Max 还是 ChatGPT Pro?我们按日志逐项算了账

更新于 October 10, 2026 · 首次发布 October 10, 2026

快速结论: 同样是每月 $100,两笔交易差别很大。我们按 API 标价,用自己的日志为 Claude Max 5x 计划的每一轮 Claude Code 对话,以及 ChatGPT Pro $100 计划的每一次 Codex 请求定价。本月两边的价格都有变动,因此下面每个数字都按今日标价计算,旁边标注了当时的价格。我们每周都用满 Claude 的周限额。在三个可比的周里,一个完整的周限额价值 $658 到...

同样是每月 $100,两笔交易差别很大。我们按 API 标价,用自己的日志为 Claude Max 5x 计划的每一轮 Claude Code 对话,以及 ChatGPT Pro $100 计划的每一次 Codex 请求定价。本月两边的价格都有变动,因此下面每个数字都按今日标价计算,旁边标注了当时的价格。我们每周都用满 Claude 的周限额。在三个可比的周里,一个完整的周限额价值 $658 到 $873 的 API 用量,中位数为 $761。一个完整的 Codex 窗口中位数价值 $179。Claude 看起来大了 4 倍。但按工作内容计价后,Claude 仍然领先,只是优势小得多。

今日标价下一个完整周的 API 价值,$100 计划对 $100 计划(我们的日志,2026 年 9 月 11 日至 10 月 9 日)。灰色 Claude 柱:促销周,不可比$0$250$500$750$1,000$419Claude 9 月 11 日$761Claude 9 月 18 日$873Claude 9 月 25 日$658Claude 10 月 2 日$179Codex Pro $100$67ChatGPT PlusClaude 满额中位数 $761
今日标价下一个完整周的 API 价值,$100 计划对 $100 计划(我们的日志,2026 年 9 月 11 日至 10 月 9 日)。灰色 Claude 柱:促销周,不可比

10 月发生了什么变化

我们上次做这项比较时,Claude 这边看起来无人能敌:按 API 价格,一个 Max 5x 周值 $1,217 或更多。此后有三件事变了。

厂商怎么说

在我们的数字之前,先看看每家厂商对你能拿到什么的说法。这些是它们的宣称,不是我们的测量。

厂商宣称来源
AnthropicOpus 5.5 标价为每百万 token 输入 $4、缓存读取 $0.20、输出 $20。Fable 5.1 标价为 $10、$0.25 和 $50,输入与输出都是其 2.5 倍。API 定价页面
AnthropicOpus 5.5 的表现接近 Fable 5.1,并且在默认 effort 下,以约五分之一的成本超过 max effort 的 Opus 5。Opus 5.5 发布文章
AnthropicOpus 5.5 在 xhigh effort 下于 Terminal-Bench 4.0 得分 66.4%,而 GPT-6 Astra 为 57.9%,Fable 5.1 为 55.8%。Opus 5.5 发布文章
AnthropicMax 5x 是“Pro 套餐每会话用量的五倍”。未公布每周数字。Max 套餐帮助页面
Anthropic从 9 月 14 日起,Claude Code 周限额提高 25%,在 50% 促销之后“使其中一部分永久化”。周限额促销页面
Anthropic在 Max 上,Fable 最多可占用你周限额的 50%,并且消耗速度快于其他模型。Fable 在你的套餐上的帮助页面
OpenAIGPT-6.1 Sol 标价为输入 $2、缓存 $0.10、输出 $10,在智能体编码上几乎与 GPT-6 Astra 持平,而 token 价格只有 Astra 的五分之一。DevDay 发布,经 Mixed News 与 AI Catchup 报道
OpenAIPro 套餐没有五小时限额。Plus 每 5 小时估计可完成 15 到 160 个 GPT-6.1 Sol Codex 任务。“周限额也可能适用。”Codex 定价页面
OpenAIPro $200 将于 10 月 30 日从 Plus 的 20 倍降至 10 倍,价格不变。引用 OpenAI 的行业媒体报道

注意两者都没有公布的内容:一个周限额究竟能容纳多少用量。Anthropic 给出的是每会话倍数,OpenAI 给出的任务范围宽至 10 倍。这就是我们要用自己的日志来定价的原因。

我们如何让各周可比

Claude 的四个周和 Codex 的七个窗口并非在相同价格或相同上限下运行。若按原价计算,最早的周看起来最大,因为同样的 token 当时更贵。我们对三件事做了修正:

重新计价大大改变了 Claude 的数字,但对总结论影响很小:未调整时,四个周分别为 $644、$953、$874 和 $658。9 月 18 日那一周从 $953 降到 $761,因为其中一半是 Opus 5 的用量。在 Codex 方面,中位数从当日价格下的 $237 变为今日的 $179。

Claude 这边:每一周都是满额上限

我们使用 Max 5x,并且每周都把它用到周限额。有些周我们用到 100% 就停下来等待重置;有一周客户端在重置前 16 分钟就显示了限额提示。无论哪种情况,下表的每一行都是一个完整的周限额。我们的日志从 9 月 11 日重新开始(旧日志已被保留策略清理),因此我们为四个完整窗口定价。窗口从周五 14:00 UTC 开始,即 Claude Code 报告的重置时间。

周开始当时价格今日价格轮次主要模型上限
9 月 11 日$644$4196,844Opus 5100%,促销上限至 9 月 14 日(不可比)
9 月 18 日$953$76113,474Opus 5, Opus 5.5100%
9 月 25 日$874$87323,337Opus 5.5, Sonnet 5.5100%
10 月 2 日$658$65812,489Opus 5.5, Sonnet 5.5, Fable 5.1100%

因此,按今日价格,一个完整的 Max 5x 周值 $658 到 $873 的 API 价值,中位数 $761。上限每周都相同,但美元价值不同。差异来自上限被花在了什么上。Claude.ai 聊天共用同一个池,但不在 Claude Code 日志中,因此聊天占比高的一周折算出的价值更低。Fable 5.1 的标价是 Opus 5.5 的 2.5 倍,而且按 Anthropic 的说法,它更快地消耗限额,因此它占上限的权重并不等于其美元占比。我们在单独一篇关于 Fable 5.1 与 Opus 5.5 的文章中讨论了这一点。

另外,在 9 月 10 日至 10 月 9 日期间,我们触发了滚动 5 小时会话限额 17 次。这才是 Claude 日常真正的摩擦:长会话在任务中途卡住,你只能等待。

原始数据:claude-max-5x-weekly-windows.csv。

Codex 这边:窗口更小,但工作更便宜

Pro $100 的七个完整 Codex 窗口,时间从 9 月 27 日到 10 月 15 日。起始日期重叠的是重置:重置会在旧窗口耗尽前开启一个新窗口。

窗口当时价格今日价格已用上限主要模型
09/27 至 10/04$277$178100%GPT-6 Sol
09/27 至 10/04$263$167100%GPT-6 Sol
09/28 至 10/05$278$179100%GPT-6 Sol
09/30 至 10/07$137$103100%GPT-6 Sol, GPT-6.1 Sol
10/02 至 10/09$186$18298%GPT-6.1 Sol, GPT-6 Luna
10/07 至 10/14$237$237100%GPT-6.1 Sol, GPT-6 Luna
10/08 至 10/15$229$22999%GPT-6.1 Sol, GPT-6 Luna

按今日价格,每个窗口为 $103 到 $237,中位数 $179,不到一个 $67 的 Plus 周的 3 倍,而非宣传的 5 倍(完整拆解见此)。原始数据:codex-pro-100-windows-repriced.csv。但 Codex 用更少的美元完成同样的工作:

测试ClaudeCodex差距
API 标价,每百万 tokenOpus 5.5:$4 输入 / $20 输出GPT-6.1 Sol:$2 输入 / $10 输出2x
DataCamp:同一个 Tetris 构建,API 成本Opus 5.5:$0.87GPT-6 Sol:$0.263.3x
codeongrass:同一个插件功能,token 数Claude Code:6.2MCodex:1.5M4.2x
Snorkel Terminal-Bench 4.0,完整 66 个任务运行成本Claude Code + Opus 5.5:$4.7k,8.0B tokenCodex + GPT-6.1 Sol:$0.6k,1.5B token约 8x
Snorkel Terminal-Bench 4.0,得分(max effort)Opus 5.5:64.8%GPT-6.1 Sol:58.2%Claude 领先 6.6 个点

Snorkel 的排行榜是我们找到的唯一一个让每个模型都运行在其本厂商智能体中(Claude Code 与 Codex)的榜单,这也是订阅所对应的使用方式。Anthropic 自己公布的 Opus 5.5 Terminal-Bench 成绩为 66.4%;OpenAI 尚未公布 GPT-6.1 Sol 的该项成绩,而是报告了 DeepSWE(75.2%)。我们下面的每任务计算采用 DataCamp 的 3.3 倍差距,这是保守的一端:Snorkel 的运行表明在 max effort 下差距更大。DataCamp 的 $0.26 是在 GPT-6 Sol 上测得的,早于缓存价格减半,所以在 GPT-6.1 Sol 上,Codex 的任务可能比我们假设的还要便宜一点。

Pro 套餐也没有 5 小时限额,而 Codex 有重置。在 12 天内,我们得到了八个窗口而非两个,价值为 $1,211 的 API 价值。重置不是你能提前规划的东西,因此我们没有把它计入下面的基线。

同样的钱买到更多:每周任务数

当同一项工作一个模型需要 3 倍的 token 时,API 美元价值就是错误的单位。用每个套餐的周价值除以其每任务成本:

基准规模的编码任务每周数,每任务 $0.87(Opus 5.5)和 $0.26(GPT-6 Sol)01,5003,0004,5006,000875Claude Max 5x688Codex Pro $100258Plus $205,154Pro $200 现在(20x)2,577Pro $200 10 月 30 日标注1,377Pro $200 10 月 30 日实测
基准规模的编码任务每周数,每任务 $0.87(Opus 5.5)和 $0.26(GPT-6 Sol)
套餐月费每周 API 价值每周任务数
ChatGPT Plus$20$67约 258
Claude Max 5x$100$658 到 $873(中位数 $761)约 756 到 1,003(中位数 875)
ChatGPT Pro $100$100$179约 688
ChatGPT Pro $200,10 月 29 日前$20020x 标注约 5,154(先前研究)
ChatGPT Pro $200,10 月 30 日起(标注)$200$670约 2,577
ChatGPT Pro $200,10 月 30 日起(我们的比率)$200约 $358约 1,377

这里的一个任务指一个基准规模的编码工作。你的任务会更大或更小,但只要 3.3 倍的成本差距成立,这些比率就成立。

2026 年 10 月的结论

这项研究不能说明什么

这是一位重度用户的日志,而非样本小组。9 月 11 日之前的 Claude 日志已被清理,因此我们无法重新核对支撑我们早先 $1,217 数字的 8 月各周。Claude.ai 聊天与周池共用,但不在日志中,因此仅在 Claude Code 中用满的一个上限,很可能比 $658 的低端更有价值。重新定价假设模型变化时套餐上限没有改变;两家厂商都没有说明更便宜的模型是否也会拉长上限。数百个使用较旧 gpt-5.5 模型的 Codex 请求没有公布价格,因此被排除。$67 的 Plus 周是更早测得的,未重新计价。GPT-6.1 Sol 的厂商宣称来自引用 OpenAI 的发布报道,因为 OpenAI 自己的文章屏蔽了自动化读取器;我们核对的所有来源中 $2 和 $10 的价格一致。美元数字是按标价计算的 API 等值价值,而非我们实际支付的钱。两家厂商都以各自的单位计量,且都没有公布换算方式。

来源

相关文章


想将这些方法用于您的技术栈吗? 请准备好供应商账单、网关日志和主要工作流;我们会梳理成本驱动因素与节省空间。 预约免费审查 →

返回 finopsllm.com