OpenAI Decisions API 成本模型:仅输入计费与快速类型化输出
更新于 October 7, 2026 · 首次发布 October 7, 2026
OpenAI 的 Decisions API 是一个 beta 端点,用于把共享的文本或图像证据转化为类型化的分类、选项或评分。使用 GPT-6 Luna 时,它每 1M 输入 token 收费 $0.10,不收缓存或输出 token 的费用。请把它宣称的“10x faster”视为延迟信号,再用你自己的工作负载测试质量和总任务成本。
OpenAI 在 2026 年 10 月 6 日发布了什么?
OpenAI 于 2026 年 10 月 6 日以公开 beta 形式推出 Decisions API。专门的 Decisions 指南称,它返回类型化答案的速度比 Responses API 快约 10 倍。发布时,GPT-6 Luna 是唯一支持的模型,请求使用 POST /v1/decisions。这一速度对比是 OpenAI 公布的说法,并不保证每个应用都能获得相同的端到端提升。
一个请求包含一份共享输入和一个或多个问题。每个问题可以要求给出谓词(某条件成立的概率)、从给定集合中选择一项,或对有序等级打分。端点会以类型化形式返回这些答案,并附带概率或置信度信息。因此它适合有边界的决策,例如路由支持工单、标记产品照片中可能的损坏,或为事故严重程度打分。
Decisions API 如何计费?
对于 Decisions 端点,OpenAI 列出的 GPT-6 Luna 价格为每 1M 输入 token $0.10。指南称只对输入 token 计费:缓存读取、缓存写入和输出 token 的费用都不适用。这与普通的 GPT-6 Luna Responses 请求不同,后者的标准短上下文费率为:每 1M 未缓存输入 token $0.10、缓存输入 $0.01、缓存写入 $0.125,以及输出 token $0.50。请使用该端点专用的 Decisions 定价条款,而不是完整的模型费率表。
以下是一个假设性的估算,尚未计入任何适用的区域或长上下文调整:如果平均每个请求使用 1,200 个输入 token,其 token 费用为 1,200 ÷ 1,000,000 × $0.10 = $0.00012。1,000,000 次这样的请求将使用约 1.2 × 10⁹ 个输入 token,费用约为 $120。这只是规划示例,并非报价。在设定预算之前,请先测量真实的 token 用量,并确认当前费率。
由于输出 token 在这里不属于计费类别,请仔细统计完整的输入:证据、请求中包含的系统上下文,以及每个问题的指令和选项。在合理的情况下,可以把针对同一输入的独立问题放在一个请求中。OpenAI 文档说明,独立问题可以共享证据;依赖前一个答案的问题应分开发送。问题应简短且可观察,以免请求在含糊的评分标准上消耗 token。
团队何时应使用 Decisions 而不是 Responses?
当结果本质上是有边界的时,使用 Decisions:“这张图片是否明显受损?”、“这三个队列中哪一个应接收这张工单?”或“按这些明确的等级,这次事故的严重程度如何?”它返回的答案可以由应用直接路由或统计,无需让通用模型写出一段文字再去解析。
对于需要解释、任意 JSON Schema、生成文本、工具调用,或需要与模型进行对话的决策,请继续使用 Responses。OpenAI 指南明确建议,当需要自定义 JSON 对象时使用 Structured Outputs,当模型需要请求工具调用时使用函数调用。类型化选项无法替代有理有据的解释,也无法替代可执行的操作。
正确的比较标准是每个正确业务结果的成本,而不是孤立地看 token 或延迟。一个快速但制造大量误报的分类器,可能反而增加人工复核的工作量。低价端点如果需要靠重复提示词、人工复核或下游纠错来弥补,仍可能得不偿失。请记录 Decision 响应中的用量和答案字段,将结果与带标签的样本对照,并把人工复核和下游处理计入每个成功路由案例的成本。
FinOps 团队如何验证节省声明?
- 选定一个有边界的工作负载。挑选一个高流量的分类或评分步骤,答案集合清晰,错误成本可衡量。
- 构建带标签的测试集。按类别衡量准确率,并检查置信度或概率的校准情况。按照 OpenAI 的建议,根据误报和漏报的成本设定人工复核阈值。
- 运行可比较的试点。在等价输入上比较当前生产路径与 Decisions。记录端点延迟、token、重试次数、复核比例,以及纠错的成本。
- 预算完整的链路。加入存储、应用计算、复核人员的时间,以及之后可能发生的 Responses 或工具调用费用。Decisions 的 token 定价并不会让工作流的其余部分变得免费。
- 保留退出路径。该端点仍处于公开 beta 阶段。在配置中固定端点和模型,关注变更日志,并在行为或可用性变化后、大范围上线前重新测试。
OpenAI 文档称,符合条件的客户可使用零数据保留(Zero Data Retention)和 HIPAA 用途,并提供美国和欧洲(EEA 及瑞士)的数据驻留选项,但需满足资格和协议要求。在将受监管数据纳入试点之前,请针对贵组织的实际配置确认这些控制措施。
采购方应记住 Decisions API 定价的哪些要点?
Decisions API 为紧凑、类型化的决策提供了一种新的价格与延迟组合:按已公布的 GPT-6 Luna 费率,输入每 1M token 收费 $0.10,生成的输出 token 不收费。它最适合的候选工作负载,具有可复用的证据、清晰的答案类型,以及捕获不确定结果的低成本方式。在迁移生产流量之前,请衡量任务质量和总运营成本。
团队应阅读哪些相关研究?
相关文章
想将这些方法用于您的技术栈吗? 请准备好供应商账单、网关日志和主要工作流;我们会梳理成本驱动因素与节省空间。 预约免费审查 →