跳至正文

Claude Max 20x 并不是 20 倍。我们用 60 天日志对比了 Codex

更新于 October 10, 2026 · 首次发布 September 27, 2026

快速结论: Claude Max 20x 和 ChatGPT Pro 20x(Codex)每月都是 $200,按 API 价格计算,两者提供的价值都是月费的许多倍。Claude Max 20x 的原始 API 价值更高:我们测得其每周限额约为 $1.86k 的 API 等价用量,而 ChatGPT Pro 20x 的预计值为 $1.34k。但 Codex 用同样的钱能完成更多工作,因为在独立测试中,GPT...

Claude Max 20x 和 ChatGPT Pro 20x(Codex)每月都是 $200,按 API 价格计算,两者提供的价值都是月费的许多倍。Claude Max 20x 的原始 API 价值更高:我们测得其每周限额约为 $1.86k 的 API 等价用量,而 ChatGPT Pro 20x 的预计值为 $1.34k。但 Codex 用同样的钱能完成更多工作,因为在独立测试中,GPT 模型完成同一编程任务所需的美元数少了 3.3 到 4.2 倍。所以在 $200 这个价位,ChatGPT Pro 20x 能多完成约 2.4 倍的任务,前提是 OpenAI 的 20x 倍数在每周窗口上同样成立,而不只是 5 小时窗口。在 $100 这个价位,两者大致持平。以我们的数据看,Claude Max 5x 略占优,因为它的每周限额从未触顶。

本页其余部分说明我们如何得出这些数字,以及如何用你自己的日志进行核对。分析基于一位重度用户 60 天的 Claude Code 与 Codex 日志,每一 Token 都按当时的 API 标价计价,并与我们能找到的所有公开测量结果进行对照。它旨在帮助那些确实难以在两款套餐之间做选择的人做出决定。下面的数字就是每个结论的依据。

如果你只想要一个答案,下面是按人们搜索时使用的说法给出的结论:

为什么不能直接比较两个“20x”套餐?

两家厂商都推出了标注“20x”的 $200 套餐,以及标注“5x”的 $100 套餐。这些标签容易让人产生比较的冲动,但这种比较站不住脚,因为两家公司乘的是不同的东西。

所以有用的问题不是“哪个 20x 更大?”而是两部分:

  1. 一整周内每个套餐能容纳多少美元的 API 等价计算量?
  2. 考虑到两类模型达到相同结果时的花费差异很大,这笔钱能买到多少完成的任务?

第一部分可以从本地日志中测量。第二部分需要独立的基准测试。我们两者都做了。

如何用美元衡量订阅限额?

两款命令行智能体都会保存完整的本地日志。Claude Code 将每一轮助手输出写入 ~/.claude/projects/**/*.jsonl,其中的 usage 块分别记录新输入、输出、缓存读取、5 分钟缓存写入和 1 小时缓存写入。Codex 则将会话写入 ~/.codex/sessions/**/*.jsonl,记录每个会话的累计 Token 数。每个 Codex 事件还携带一个 rate_limits 对象:5 小时窗口和每周窗口各自的已用百分比与重置时间。

对每一轮,我们按该模型当时的 API 标价计算 Token 费用:

cost = input·pin + output·pout + cache_read·pcr + write5m·pw5 + write1h·pw1

轮次按消息 ID 和请求 ID 去重,因为 Claude Code 会重复记录流式分块。Codex 报告的是累计总量,因此我们计算相邻事件之间的差值,并在会话重置计数器时开始新的计数。推理 Token 已包含在 Codex 的输出计数中,因此不会被重复计入。

模型输入 $/M输出 $/M缓存读取 $/M缓存写入 $/M(5 分钟 / 1 小时)
Claude Opus 55.0025.000.506.25 / 10.00
Claude Opus 5.54.0020.000.205.00 / 8.00
Claude Fable 5 / 5.110.0050.001.00 / 0.2512.50 / 20.00
Claude Sonnet 52.0010.000.202.50 / 4.00
GPT-6 Sol / GPT-5.6 Sol2.0010.000.20—
GPT-5.55.0030.000.50—
GPT-5.42.5015.000.25—

套餐的限额可以用两种方式换算成美元。

一个 Claude Max 20x 周包含多少用量?

按今天的限额计算,约为 $1.9k 的 API 计价用量,取决于模型组合,范围在 $1.74k 到 $2.2k 之间。在 8 月份的一次促销期间(限额提高到 150%),我们的用户两次触及每周上限,分别为 $2,085 和 $2,379。

每周 Claude Code 用量(API 美元)$0$0.5k$1.0k$1.5k$2.0k$2.5k$3.0kMax 20x 每周上限,150% 促销:$2.1k–2.6k+$389Jul 31$2,087Aug 7触顶$2,380Aug 14触顶$2,091Aug 21$2,636Aug 28$1,461Sep 4$656Sep 11$984Sep 18$504Sep 25*Max 20x($200)Max 5x($100)Claude Code,每个周窗口的 API 等价美元(周五 13:00 UTC)
每个柱子代表一个周限额窗口,按当天的 Anthropic 标价计价。“CAP HIT”标记 Claude Code 记录到“You’ve hit your weekly limit”的周。8 月 28 日那一周超过了 $2.6k 仍未触顶,因此上限并非固定的美元数额。Max 5x 从未触及每周上限。*表示不完整的周。
窗口(周五 13:00 UTC)套餐API 等价 $助手轮次缓存读取主要模型每周上限
7 AugMax 20x$2,08722,5171.85BOpus 5 $1,380, Fable 5 $628在 $2,085 触顶
14 AugMax 20x$2,38024,9012.26BOpus 5 $2,029, Fable 5 $326在 $2,379 触顶
21 AugMax 20x$2,09121,2592.00BOpus 5 $1,668, Fable 5 $272未触顶
28 AugMax 20x$2,63628,5502.66BOpus 5 $2,234, Fable 5.1 $234未触顶
4 SepMax 5x$1,46120,9731.87BOpus 5 $1,304, Sonnet 5 $140未触顶
11 SepMax 5x$6566,8370.66BOpus 5 $578, Fable 5.1 $39未触顶
18 SepMax 5x$984———未触顶

我们的用户在 8 月内两次触及 Max 20x 的每周上限:在 8 月 14 日(按正文)于 $2,085 时,以及在 8 月 19 日于 $2,379 时。随后那一周在 $2,091 时停止且未触顶,8 月 28 日那一周达到 $2,636 也同样未触顶。因此上限并非固定的美元数额。Anthropic 以其自有单位计量套餐,而这些单位对每个模型映射到标价的方式各不相同。以 Fable 为主的一周(每个 Token 的成本是 Opus 的两倍)会在更少的美元下触顶,而几乎全是 Opus 的一周则不会。这与两次触顶的周相吻合:较早的触顶周的 Fable 花费几乎是后一周的两倍($628 对 $326),却在少了 $300 的情况下触顶。

四周都发生在将限额提高到正常水平 150% 的促销期间。之后限额已恢复到 125%。将观察到的范围按 125/150 缩放,今天 Max 20x 的每周上限大致为 $1.74k 到 $2.2k 的 API 等价用量。我们取 $1.86k 作为中心估计值,即两次触顶数值缩放后的平均值。

整月数据也呈现同样的图景。8 月份,在 Max 20x 上,我们的用户以 $200 的费用使用了 $8,676 的 Claude API 等价用量,是价格的 43 倍。9 月 1 日至 27 日,主要使用 $100 的 Max 5x,数字为 $4,511,即价格的 45 倍。Finout 对 Claude Code 成本的调查显示,重度用户每月的 API 价值在 $600 到 $1,500 之间,因此这位用户远高于典型用量。请把这里的数字视为一个套餐所能提供的上限。

为什么 Claude Code 的账单主要是缓存,而不是输出?

因为智能体在每一步都会重新读取它的整个工作上下文。8 月份,缓存读取占我们用户消耗 Token 的 96%,而输出 Token 只占 $6,986 的 Opus 账单中的 $1,038。

Opus 5 八月账单:Token 占比与费用占比Claude Opus 5,2026 年 8 月:Token 去向与费用去向Token 占比96%费用占比50%35%15%缓存读取缓存写入(1 小时)输出新输入
7.0B 个缓存读取 Token(占总量 96%)构成了 $6,986 Opus 5 账单的 50%。输出 Token 是大多数成本模型所依据的数字,它只占总量的 0.6%,却占成本的 15%。1 小时费率($10/M)的缓存写入是隐藏的第二笔开销。
Opus 5,2026 年 8 月Token 数费率成本成本占比
缓存读取7,021M$0.50/M$3,51050%
缓存写入,1 小时 TTL243.7M$10.00/M$2,43735%
输出41.5M$25.00/M$1,03815%
新输入0.22M$5.00/M$1<0.1%
合计7,307M$6,986100%

智能体编程会话在每一步都会重新读取其整个上下文:系统提示词、工具定义、打开的文件以及至今的对话。其中几乎没有新的输入。它以输入价格十分之一的缓存读取形式返回,但在 7B Token 的月用量下,这十分之一加起来就占了账单的一半。Claude Code 还会以一小时的生命周期写入缓存,其成本是输入价格的两倍,因此一个不断延长上下文的会话会反复支付这笔溢价。

这对 FinOps 有直接影响。仅以输出 Token 为基础的预测,会把智能体编程的用量低估约七倍。输出只占 Token 总量的 0.6%,却占成本的 15%。任何面向编程智能体的 showback 或 chargeback 模型,都必须将缓存读取和缓存写入作为独立的计费项目,否则误差会达到一个数量级。

这也解释了为什么与 API 相比,Claude 订阅看起来如此慷慨。Anthropic 以其自有单位计量订阅。按标价计算,缓存密集型的流量恰恰是能把 $200 的月费变成每周 $2,000 API 等价价值的那类流量。

Claude Max 5x 先触及哪个限额:会话还是每周?

5 小时会话限额。9 月份它让我们的用户触顶了 12 次,每次触顶前的工作中位数为 $37,而 Max 5x 的每周上限从未被触及。

Max 5x 会话限额触顶Claude Max 5x:限额触顶时 5 小时窗口内的 API 美元$0$20$40$60$80$100$120$140中位数 $37
9 月份在 5 小时窗口中有 12 个不同窗口触及限额。中位数 $37,平均 $44。较低的数值是用户进入时已经部分消耗的窗口;$93 和 $127 的窗口则代表一次完整、有意的会话所能容纳的量。

在 Max 5x 上,每周上限从未触及,即使在 $1,461 的那一周也没有。5 小时会话限额在 9 月触顶 12 次。每次触顶前窗口内已用的美元在 $5 到 $127 之间,中位数为 $37,平均为 $44。分布较散,是因为一个会话可能在用户已经用掉上一个窗口的一部分时开始。最大的两个值 $93 和 $127,最能说明一个完整且有意的 Max 5x 会话能容纳多少。

这形成了不同的使用模式。Max 20x 用户会撞上每周限额,而 Max 5x 用户几乎每个下午都会撞上限额。如果你的工作以长时间、不间断的会话为主,那么 Max 5x 的 5 小时限额造成的损失会比它的每周上限更大。

ChatGPT Plus 和 Pro 每周包含多少 Codex 用量?

自 2026 年 8 月起,一个完整的 Plus 周的 Codex 按 API 价格计算,中位数价值为 $67。按 OpenAI 公布的倍数换算,Pro 5x 约为每周 $335,Pro 20x 约为 $1,340。

Codex Plus 每周窗口价值随时间变化$0$40$80$120$160$200$240MarAprMayJunJulAugSepGPT-5.4 / 5.5 时期:中位数 $115GPT-5.6 / 6 时期:中位数 $67ChatGPT Plus(Codex):一个完整每周窗口所含的 API 等价美元
每个点代表一个每周窗口。价值 = 100 × API 美元花费 ÷ 每周计量表已消耗的百分点;点的大小代表该窗口的用量比例(已用不足 30 个百分点的窗口已剔除)。8 月的下降更多是受价格表影响,而非配额:GPT-5.6 Sol 标价为 $2/$10,而 GPT-5.5 为 $5/$30。
月份Codex API 等价 $(Plus,$20)相当于月费的倍数每个完整每周窗口的中位数 $
Mar 2026$53527x$115(Mar–Jul,GPT-5.4 / 5.5)
Apr 2026$31616x
May 2026$20210x
Jun 2026$30215x
Jul 2026$73637x
Aug 2026$64032x$67(Aug–Sep,GPT-5.6 / GPT-6 Sol)
Sep 2026$25513x

我们在 Plus 套餐上测量了 27 个每周 Codex 窗口。综合所有窗口,一个完整的每周窗口在 API 价格下价值 $103,一个完整的 5 小时窗口价值 $29.8。不过综合数字掩盖了一个明显的断点。3 月至 7 月,中位窗口价值为 $115。8 月以来,它的中位数为 $67,而且近期的窗口分散得更少:连续七个窗口都落在 $61 到 $81 之间。

这一下降主要来自价格,而不是配额缩小。8 月,Codex 的默认模型改为 Sol,其标价为输入 $2、输出 $10,而 GPT-5.5 为 $5 和 $30。如果 OpenAI 的每周配额与计算量挂钩,那么更便宜的 Token 意味着每个窗口能换到的美元更少。预测时请使用近期数字。我们取 $67 作为一个 Plus 周的价值。

我们没有跑过 Pro 5x 或 Pro 20x。下面的 Pro 数字是推算值,计算方式为 $67 乘以 OpenAI 公布的倍数:Pro 5x 每周 $335,Pro 20x 每周 $1,340。整个比较取决于这一假设,我们将在下文对其进行检验。

Claude Max 20x 值得为此多花 Max 5x 的钱吗?

对大多数重度用户来说,不值得。Max 20x 的价格是两倍,但其每周额度只约为 Max 5x 周额度的 1.5 到 2 倍,而不是标签暗示的 4 倍。

20x 档相对 5x 档:宣传倍数与实测每周比率每周而言,$200 档比 $100 档大多少?宣传值:Claude Max 20x ÷ 5x(每 5 小时会话)4.0x公布值:ChatGPT Pro 20x ÷ Pro 5x(Codex)4.0x实测:codeongrass,Claude 每周≈2.0x实测:我们的日志,Claude 每周(上限)≤1.5x
Claude 的“20x”适用于 5 小时会话。它的每周上限才是约束重度用户的因素,其大小并非 Max 5x 每周上限的四倍。我们的上限估计:Max 20x 的上限为 $2.1k–2.6k,而 Max 5x 在某一周内交付了 $1,461 且未触及上限。

如果 Claude 各档位按标签的倍数扩展,那么一个 Max 20x 周应当容纳四倍于一个 Max 5x 周的量。证据显示最多约为其一半。

本研究中最重要的实际结论是:在 Claude 上,按每美元计算,Max 5x 是更划算的选择,因为它的价格只有一半,却提供了远超一半的每周容量。Max 20x 多出的 $100 主要买的是更长的 5 小时会话。只有当限制你的是会话上限而不是每周上限时,才值得为此付费。

完成同一任务时,Codex 比 Claude Code 便宜吗?

是的,在两项独立测试中便宜 3.3 到 4.2 倍,因为 GPT-6 Sol 用更少的 Token 就能达到相同结果。Claude 在基准测试质量上仍然领先。

按 API 等价美元计算衡量的是厂商让渡了多少,而不是用户得到了什么。一个完成同样工作需要四倍 Token 的模型,会把更大的额度转化为同样多的输出。有两个独立来源直接测量了这一点。

来源任务ClaudeOpenAIClaude ÷ OpenAI
DataCamp构建一个可玩的俄罗斯方块克隆Opus 5.5: $0.87GPT-6 Sol: $0.263.3x 美元
codeongrass同一代码仓库中的相同插件功能Claude Code:6,232K tokensCodex:1,499K tokens4.2x(按 Token)

无论哪个方向,质量都不能弥补这一差距。在 Terminal-Bench 4.0 上,Opus 5.5 得分 66.4%,GPT-6 Sol 得分 60.5%。这确实是真实的领先,但六个百分点的优势无法抵消常规工作中 3.3 倍的成本差距。Claude 的优势值得为困难、模糊、多步骤的问题付费。但当工作是清理一批定义清晰的工单时,就不值得为此付费。

以 DataCamp 的数字作为工作单位。一个俄罗斯方块规模的任务在 Claude 上花费 $0.87,在 GPT 上花费 $0.26,每个套餐的每周容量便可换算为任务数:

各套餐以 API 美元和任务数计算的容量各套餐每周容量:API 美元与完成的任务数API 等价 $ / 周Claude Max 20x · $200$1,860ChatGPT Pro 20x · $200$1,340Claude Max 5x · $100$1,218ChatGPT Pro 5x · $100$335ChatGPT Plus · $20$67每周俄罗斯方块规模的任务数2,1385,1541,3991,288258实测根据 Plus × OpenAI 倍数推算
左图:一个完整周在 API 标价下的价值。右图:同一周除以一个可比编程任务的成本(Opus 5.5 为 $0.87,GPT-6 Sol 为 $0.26,DataCamp 数据)。Claude Max 20x 采用中心上限估计值($1.86k);Max 5x 为下限,因为其每周上限从未被触及。
套餐月费每周 API $依据每周任务数每个任务的费用
Claude Max 20x$200$1,860实测上限,按 125% 换算2,138$0.022
ChatGPT Pro 20x$200$1,340Plus × 20,推算5,154$0.009
Claude Max 5x$100≥ $1,217未触及上限(下限)≥ 1,399≤ $0.017
ChatGPT Pro 5x$100$335Plus × 5,推算1,288$0.018
ChatGPT Plus$20$67实测258$0.018

“每个任务的费用”是订阅费的每周分摊(月费 ÷ 4.33)除以每周任务数。每一行都比同一任务的 API 价格低两个数量级,因此对于认真使用的人来说,每款套餐都比按 Token 付费划算。

ChatGPT Pro 20x 真的提供 20 倍的每周 Codex 用量吗?

OpenAI 没有书面说明,而这是唯一可能改变本研究结论的数字。只要真实的每周倍数高于约 7 倍,Codex 在 $200 价位上就保持领先。

Codex Pro 的各行都基于一个假设:Pro 20x 的每周窗口确实等于二十个 Plus 周。OpenAI 公布的是 5 小时窗口的 20 倍。Anthropic 的经验是,每个会话 20 倍最终变成了每周约 2 倍,这说明两者未必一致,是一个警示。因此我们不去假设,而是问:要让 Codex 获胜,真实的每周倍数 m 必须有多大。

Codex 每周任务数 = m × $67 ÷ ($0.87 ÷ r),其中 r 是 Claude 每个任务多花费的倍数。

ChatGPT Pro 20x 的盈亏平衡每周倍数01k2k3k4k5k6k7k1x4x8x12x16x20xChatGPT Pro 20x 相对 Plus 的实际每周倍数Claude Max 20x:约 2,138 个任务/周8.4x6.6xCodex,Claude 每个任务成本为 4.2xCodex,3.3xChatGPT Pro 20x 在任务数上超过 Claude Max 20x 的临界点
一旦每周额度至少达到 Plus 的 6.6–8.4 倍,Codex Pro 20x 交付的完成任务数就超过 Claude Max 20x。OpenAI 为 5 小时窗口公布了 20 倍。如果每周窗口以同样的方式扩展,Codex 约多 2.4 倍;如果像 Claude 那样扩展,则 Claude 获胜。
Claude 每个任务的相对成本 (r)m = 20 时 Codex Pro 20x 的每周任务数相对 Claude Max 20x 的盈亏 mm 达到盈亏点时的结论
3.3(DataCamp)5,1548.4xCodex 获胜
4.2(codeongrass)6,4726.6xCodex 获胜
2.0(Claude 效率较高的困难任务)3,08013.9x仅接近完整 20 倍时 Codex 获胜

如果 OpenAI 的每周额度哪怕只有其标签倍数的三分之一,ChatGPT Pro 20x 交付的完成工作量也会超过 Claude Max 20x。如果它像 Anthropic 那样只有 2 倍,Claude 则会明显获胜。你可以在购买 Pro 的第一周就验证这一点。留意 Codex 已经显示的每周计量表:如果一个相当于 Plus 大小的完整工作日让它移动约 1 个百分点,那么你就拿到了完整的 20 倍。

$200 的 AI 编程订阅比 API 便宜吗?

这些套餐都比按 Token 付费划算,而且优势很大。每周 $46 的 API 等价用量就足以让一个 $200 订阅回本,$100 套餐则为 $23。这相当于大约两小时的稳定 Opus 智能体工作,或一个重度下午。我们的用户每周一都会超过这条线。

套餐盈亏点(每周 API $)我们用户的典型一周价值倍数
Claude Max 20x($200)$46$2,087–2,63645–57x
Claude Max 5x($100)$23$656–1,46128–63x
ChatGPT Plus($20)$4.62每个完整窗口 $61–8113–18x

Claude Max 还是 ChatGPT Pro:$100 或 $200 该买哪个?

如果你……购买原因
大多数日子都用智能体编程,但很少整天都在用 Claude Max 5x,$100 我们测得的每美元最佳容量。它的每周上限从未被触及。
通过一队定义清晰的工单稳定推进工作 ChatGPT Pro 20x,$200 每个完成任务的固定费用最低,如果 20 倍在每周成立,吞吐量约为 Claude 的 2.4 倍。
运行长时间无人值守的智能体会话,并且经常撞上 5 小时限额 Claude Max 20x,$200 你付的是会话倍数,这才是真正达到 4 倍的部分。
处理困难、模糊、跨模块的重构 Claude,5x 或 20x基准测试优势出现在 Token 数对任务影响最小的地方。
不确定,或预算有上限 Claude Max 5x + ChatGPT Plus,$120 两个模型家族、两个独立的限额池,两者合计每周约 $1.3k 的 API 价值。
需要用于你的客户所使用的产品 两者都不买,使用 API。 订阅用量无法按请求归因,且消费者条款不涵盖转售。

一项可用性提示:buildthisnow 报告称,自 2026 年 9 月 10 日起,ChatGPT 的 $200 Pro 档位已暂停接受新注册。在围绕它规划推广之前请先确认。

$200 拆分到 Claude Max 5x 与 ChatGPT Pro 5x 更好吗?

它胜过 Claude Max 20x,但不及 ChatGPT Pro 20x。几份指南现在建议购买两个 $100 套餐,而不是一个 $200 套餐。按我们的数据,这种拆分至少能提供每周 2,687 个任务,而 Claude Max 20x 为 2,138 个,ChatGPT Pro 20x 为 5,154 个。

每月 $200 分配为每周 API $每周任务数限额池
Claude Max 20x$1,8602,138一个
Claude Max 5x + ChatGPT Pro 5x≥ $1,552≥ 2,687两个,相互独立
ChatGPT Pro 20x$1,3405,154一个

这种拆分的优势体现在表格未显示的地方。你同时获得两个模型家族,因此困难的重构交给 Opus,工单队列交给 Sol。当一家厂商的限额在下午耗尽时,另一家仍有自己的额度。而且如果 Pro 20x 的每周窗口最终远低于 20 倍,那么拆分是更安全的选择,因为它对该倍数的依赖要小得多。

面向 FinOps 团队

局限性

新内容:12 天的真实 Codex Pro $100 日志

我们记录了一个重度 Codex 双周使用期内的每一个 Token,并公开了数据。一个完整的 Pro $100 周在 API 价格下价值 $175,因此真实倍数是 Plus 的 2.6 倍,而不是 5 倍。利用全局重置和储存的重置,我们在 12 天内获得了8 个每周窗口,价值为$1,211 的 API 用量。我们还算清了何时兑换储存的重置,以及为什么98% 的输入是缓存的。每篇文章都附有 CSV。

来源

相关文章


想将这些方法用于您的技术栈吗? 请准备好供应商账单、网关日志和主要工作流;我们会梳理成本驱动因素与节省空间。 预约免费审查 →

返回 finopsllm.com