GPT-6 定价:Astra、Sol 与 Luna
更新于 September 23, 2026 · 首次发布 September 23, 2026
OpenAI 的 GPT-6 系列现在有三款模型。GPT-6 Astra 于 2026 年 9 月 3 日推出。GPT-6 Sol 和 GPT-6 Luna 于 2026 年 9 月 22 日发布,比 Anthropic 发布 Claude Opus 5.5 晚约 90 分钟。本页列出 OpenAI 定价页上的全部 GPT-6 API 价格(读取日期为 2026 年 9 月 23 日),并说明账单的实际来源。
GPT-6 API 价格(每 1M token)
标准层级,提示词输入最多 272K token。
| 模型 | 输入 | 缓存输入 | 缓存写入 | 输出 |
|---|---|---|---|---|
| GPT-6 Astra | $10.00 | $1.00 | $12.50 | $50.00 |
| GPT-6 Sol | $2.00 | $0.20 | $2.50 | $10.00 |
| GPT-6 Luna | $0.10 | $0.01 | $0.125 | $0.50 |
三款模型的规律相同:缓存输入是输入价格的 10%,缓存写入是输入的 1.25×,输出是输入的 5×。Astra 是 Sol 的 5×,Sol 是 Luna 的 20×。
GPT-6 与 GPT-5.6:变化在哪里
| 层级 | GPT-5.6 输入 / 输出 | GPT-6 输入 / 输出 | 变化 |
|---|---|---|---|
| Sol | $4.00 / $20.00 | $2.00 / $10.00 | 输入输出均 −50% |
| Luna | $0.20 / $1.20 | $0.10 / $0.50 | 输入 −50%,输出 −58% |
| Terra | $2.00 / $12.00 | 暂无 GPT-6 Terra | — |
OpenAI 定价页注明,上表中 GPT-5.6 Sol 的价格是促销价,至少持续到 2026 年 11 月 21 日。GPT-5.6 Terra 目前还没有 GPT-6 的继任者。GPT-6 Sol 的输入价格与 Terra 相同,输出价格更低,因此 Terra 的工作负载是最先应该迁移的对象。
批处理、flex 与快速模式
| 模型 | 批处理或 flex(输入 / 缓存 / 输出) | 快速模式(输入 / 缓存 / 输出) |
|---|---|---|
| GPT-6 Astra | $5.00 / $0.50 / $25.00 | $20.00 / $2.00 / $100.00 |
| GPT-6 Sol | $1.00 / $0.10 / $5.00 | $4.00 / $0.40 / $20.00 |
| GPT-6 Luna | $0.05 / $0.005 / $0.25 | $0.20 / $0.02 / $1.00 |
批处理和 flex 为半价,快速模式为双倍价格。快速模式即原来的优先处理(priority),于 2026 年 7 月 30 日更名,service_tier: "priority" 和 service_tier: "fast" 目前都仍可使用。这次更名对成本追踪很重要:如果仪表盘按旧的层级名称过滤,就可能漏掉快速模式的支出。对于 2026 年 3 月 5 日及之后发布的模型(包括全部 GPT-6),数据驻留端点会额外收取 10%。
272K 长上下文的价格跳升
三款模型都有 1,050,000 token 的上下文窗口、922,000 token 的输入上限,以及最多 128,000 个输出 token。当输入超过 272K token 时,整个请求都会按长上下文价格计费:输入和缓存输入为 2×,输出为 1.5×。
| 模型 | 长上下文输入 | 缓存 | 输出 |
|---|---|---|---|
| GPT-6 Astra | $20.00 | $2.00 | $75.00 |
| GPT-6 Sol | $4.00 | $0.40 | $15.00 |
| GPT-6 Luna | $0.20 | $0.02 | $0.75 |
这是一道台阶,而不是斜坡。以一次 GPT-6 Sol 请求为例:90% 的提示词命中缓存,输出 20K token。输入为 270K 时费用为 $0.303;输入为 300K 时费用为 $0.528。上下文只多了 11%,成本却多了 74%。由于倍率相同,Astra 和 Luna 也有同样的 74% 跳升。不加控制的智能体会在无人决定的情况下越过 272K。应在这条线之前修剪或摘要历史记录,并对超过该值的请求设置告警。
影响成本的规格
| 模型 | 知识截止 | 推理强度 | Tier 1 限额 |
|---|---|---|---|
| GPT-6 Astra | 2026 年 4 月 30 日 | low、medium、high、xhigh、max | 500 RPM,500K TPM |
| GPT-6 Sol | 2026 年 4 月 20 日 | none、low、medium(默认)、high、xhigh、max | 500 RPM,500K TPM |
| GPT-6 Luna | 2026 年 5 月 18 日 | none、low、medium(默认)、high、xhigh、max | 500 RPM,500K TPM |
Astra 没有 none 设置,因此它始终会进行推理。推理强度对账单的影响与模型本身一样大:在 Artificial Analysis 智能指数上,GPT-6 Sol 在 low 强度下每个任务成本为 $0.13,在 max 强度下为 $1.06。各强度的完整数据见 真实单任务成本。
一个智能体步骤的成本
一个步骤:200K 输入 token,其中 90% 来自缓存,输出 20K token,按标准列表价格计算。
| 模型 | 每步成本 | 每 10,000 步 |
|---|---|---|
| GPT-6 Luna | $0.014 | $138 |
| GPT-6 Sol | $0.276 | $2,760 |
| Claude Opus 5.5 | $0.516 | $5,160 |
| GPT-5.6 Sol | $0.552 | $5,520 |
| GPT-6 Astra | $1.380 | $13,800 |
ChatGPT 与 Codex 单独计费
GPT-6 Sol 和 Luna 正在 ChatGPT Work 与 Codex 中向 Plus、Pro、Business、Enterprise 和 Edu 用户推出,免费版和 Go 版用户可在桌面应用中使用 Luna。这些都是订阅计划。本页列出的价格不适用于订阅计划,ChatGPT 套餐也从不覆盖 API 用量。
应该使用哪一款 GPT-6 模型
- GPT-6 Luna:分类、抽取、摘要和路由。参见 GPT-6 Luna 成本模型。
- GPT-6 Sol:编码和智能体的默认选择。参见 GPT-6 Sol 成本模型。
- GPT-6 Astra:只在你自己的任务回放显示 Sol 失败的场景中使用。参见 GPT-6 Astra 成本模型。
价格会变动。LLM API 定价追踪器会实时读取 OpenAI 定价页,并自动获取新的 GPT-6 模型。
相关文章
想将这些方法用于您的技术栈吗? 请准备好供应商账单、网关日志和主要工作流;我们会梳理成本驱动因素与节省空间。 预约免费审查 →