目标驱动与 Ralph 循环:控制智能体开销
Updated August 16, 2026 · first published August 16, 2026
开放式任务(如大型代码重构)极易陷入成本失控。DeepSeek Harness 通过“步骤 (Step)、轮次 (Turn)、循环轮数 (Round)”以及 Ralph 循环 构建了严密的控制边界。
概念分层:Step、Turn 与 Round
- Step: 一次模型推理调用及触发的工具执行,是计费的原子单位。
- Turn: 一次完整的用户交互与智能体响应周期。
- Round: 针对持久化目标(Goal)的一轮高级策略执行。
Ralph 循环:重置上下文以节约 Token
当智能体在长上下文中不断受挫时,上下文会充满历史错误。Ralph 循环通过优雅重置当前上下文、仅保留核心目标和进度快照,实现有意识的重新开始,大幅降低输入 Token 账单。
Related
Want this applied to your own LLM spend? FinOps LLM runs a free audit of your AI costs and shows where the savings are. Book free audit →