什么时候先给计划,什么时候直接做?
教学案例:登录超时任务可以先搜索再形成计划,也可以在范围清楚时直接读取最可能的文件。计划不是每次都要先生成的一篇长文。
用户需要的是下一阶段要做什么、会影响哪些文件、何时需要确认、拿什么验证。新错误出现后,计划必须能够改变;展示模型全部内部推理并不会让产品更可信。
不要把 Agent 理解成机械执行“先计划、再行动”的流水线。实际工作中,它可能先读一份资料、形成暂时判断、再读取更多证据,或者行动后立即验证。复杂或高风险任务适合把里程碑展示给用户,轻任务则不必用长计划制造等待。
不同任务需要不同计划模式
搜索和读取限定目录通常可以直接做;准备改两个文件时,应展示修改范围和准备运行的测试;如果任务扩展到跨仓库或发布,则要先给用户看阶段和控制点。
是否展示计划由不确定性、影响范围和可逆性决定。简单任务被长计划阻塞,也是产品失败。
独立研究查看这一结论的依据与边界+
ReAct 论文提出让语言模型交错生成推理痕迹与行动,并根据环境观察继续处理。
YAReAct: Synergizing Reasoning and Acting论文 / 基准 · 核验 2026-07-14Observation 必须能够推翻计划
计划是工作假设。第一次测试表明不是时间单位错误,而是客户端提前取消请求时,系统要保留已经排除的原因,修改剩余步骤,并说明为什么换方向。
重规划首先是状态变化:旧步骤作废,新证据加入,范围或确认点改变。重新生成一篇更长的计划,不等于真正调整了任务。
官方事实查看这一结论的依据与边界+
Anthropic 将简单可组合的工作流与动态 Agent 作为不同设计选择,并强调按任务复杂度使用合适模式。
ANBuilding effective agents官方工程文章 · 核验 2026-07-14有术语没听懂?在这里用人话再看一遍4 个词+
- Reasoning
- 模型依据当前输入判断下一步的过程;产品通常无需展示完整私有思维链。
- Planning
- 把目标组织为步骤、依赖、检查点和完成证据的工作假设。
- Acting
- 调用工具、修改文件、查询系统或产生其他真实环境变化。
- 重规划
- 新观察使旧假设失效后,对剩余路径和范围做显式调整。
本章依据与证据边界1 条补充结论 · 1 份原始材料+
下面补充本章的其他依据,并说明每份材料能证明什么、不能证明什么。
- [3]
本站的三档计划模式与用户可见性规则是产品教学推演,不是 ReAct 论文规定的界面标准。
本站推演YAReAct: Synergizing Reasoning and Acting论文 / 基准 · 核验 2026-07-14