护栏与审核检查的成本
更新于 September 1, 2026 · 首次发布 September 1, 2026
一个生产环境中的 LLM 功能很少只调用一次模型。它会做你设计的那次调用,然后再加上之后为安全而添加的一次或多次调用:输入分类器、输出检查、策略评判器,有时还有第二个模型来给第一个模型打分。每一项都是推理,而推理是要计费的。
倍数比看上去大
请诚实地统计这些检查。输入审核会读取完整的用户输入。输出审核会读取完整的生成结果。策略或事实依据评判器通常会同时读取两者,外加检索到的上下文和一份评分标准,这使得评判调用比它所评判的调用还要大。再加上越狱分类器和 PII 扫描,一次用户请求就变成了五次推理调用。
这些成本并不相等。专用审核端点在某些供应商那里便宜甚至免费。但把通用模型用作评判器就不同了:它与其他调用的计价方式相同,而用一份长篇评分标准去评判一个长回答,本身就是一次长调用。
支出实际在哪里累积
有三种模式占主导。用前沿模型做评判,因为复用同一个客户端最省事。分类恰恰是小模型确实足够的任务,而这往往是可获得的最大单项节省。在长对话的每一轮都做检查,反复扫描本来已经通过审核的历史内容。还有对内部流量也启用护栏:评估框架或内部工具会继承整套面向消费者的安全栈,而它们其实并不需要。
把它作为一项预算,而不是四舍五入的误差
重点不是去掉这些检查。而是要认识到,一套安全栈可能占到某个功能推理成本的 30–50%,却没有出现在任何计划里,因为大家只计算了回答问题的模型,没有计算检查问题的模型。
在遥测中单独标记护栏调用,使这一比例可见。然后使用满足所需准确率的最便宜模型,只对新内容运行检查,而不是对整段历史重复检查,并针对每个入口,决定特定流量类别实际需要哪些检查。
相关阅读
相关文章
想将这些方法用于您的技术栈吗? 请准备好供应商账单、网关日志和主要工作流;我们会梳理成本驱动因素与节省空间。 预约免费审查 →