跳至正文

GPT-6 Luna 成本模型

更新于 September 23, 2026 · 首次发布 September 23, 2026

GPT-6 Luna 是 OpenAI GPT-6 系列中的廉价模型,于 2026 年 9 月 22 日与 GPT-6 Sol 一同发布。OpenAI 将它定位于高吞吐量工作,目标很明确:摘要、抽取和快速问答。每 1M 输入 token $0.10 的价格,使它成为应当首先路由到的模型,只有在任务证明确实需要更多能力时才切换。

GPT-6 Luna 价格

档位 输入 缓存输入 输出
标准 $0.10 $0.01 $0.50
批处理或灵活 $0.05 $0.005 $0.25
快速模式 $0.20 $0.02 $1.00
长上下文(输入超过 272K) $0.20 $0.02 $0.75

以上为每 1M token 的价格,来源为 OpenAI 定价页面。缓存写入为 $0.125。Luna 与 GPT-6 其他型号共享 1,050,000 token 的上下文窗口,知识截止日期为 2026 年 5 月(三者中最新),推理强度范围从 none 到 max 全部可用。

与 GPT-5.6 Luna 分数相同,每任务便宜 61%

Artificial Analysis 在 max 推理强度下,用其 Intelligence Index(v4.3.2)测试了两代 Luna。

模型 指数得分 每任务成本 输出速度
GPT-6 Luna(max) 37 $0.07 132.2 tokens/s
GPT-5.6 Luna(max) 37 $0.18 142.3 tokens/s
GPT-6 Sol(low) 33.9 $0.13 —

分数没有变化,每任务成本下降了 61%,主要来自更低的单 token 价格。GPT-6 Luna 在 max 下,无论分数还是成本,都胜过 low 推理强度下的 GPT-6 Sol。如果你为了省钱而在 low 下运行 Sol,那么在这一指数上,max 下的 Luna 是更划算的选择。

高吞吐量的成本

每月一百万次分类请求,每次 600 个输入 token 和 100 个输出 token,不使用缓存:

模型 月成本
GPT-6 Luna,批处理 $55
GPT-6 Luna $110
GPT-5.6 Luna $240
Claude Haiku 4.5 $1,100
GPT-6 Sol $2,200
GPT-6 Astra $11,000

Claude Haiku 4.5 的单 token 价格高 10×,作为非推理模型,它在同一指数上得分为 15。把同样的工作从 Sol 迁移到 Luna,账单降低 95%,这就是为什么只把困难案例路由到 Sol 的路由器值得去做。

代价:延迟与冗长

上面的指数数据是在 max 推理强度下测得的,而在 max 下,Luna 的首个 token 出现得很慢。Artificial Analysis 测得首 token 时间为 104 秒。它在整个指数测试中还使用了 150M 个输出 token,而中位数为 84M,Artificial Analysis 将其描述为略显冗长。这种冗长已经包含在每任务 $0.07 之中,因此成本数字依然成立,但这种等待并不适合面向用户的聊天。

对于交互式流量,请在 none、low 或默认的 medium 下运行 Luna,并在你自己的提示词上测量准确率。本页的分数仅针对 max 推理强度,因此较低设置下的准确率需要你自己测试,而无法直接查到。把 max 推理强度留给批处理任务,那里延迟无关紧要,而批处理定价又能再把账单减半。

速率限制的扩展性优于 Sol

Luna 在 Tier 1 的起始速率为每分钟 500K token,与 Sol 相同,但在 Tier 5 可达每分钟 180M token(Sol 止于 40M),并支持最高每分钟 30,000 次请求。对于批量流水线而言,这部分余量与价格同样重要。

如何使用 Luna

来源:OpenAI GPT-6 Luna 模型页面、Artificial Analysis:GPT-6 Luna、Artificial Analysis:GPT-5.6 Luna、TechCrunch。价格查询日期为 2026 年 9 月 23 日。

相关文章


想将这些方法用于您的技术栈吗? 请准备好供应商账单、网关日志和主要工作流;我们会梳理成本驱动因素与节省空间。 预约免费审查 →

返回 finopsllm.com