智能体入门课
goal_monitor_replan进阶85 分钟

6C

目标、计划与优先级:让 Agent 知道何时算完成

参考:来源 F · 第 6、11、20 章

学完你能做到

  • 把模糊愿望改写成可监控目标
  • 设计里程碑、成功条件和失败条件
  • 处理任务冲突与动态重排优先级

目标监控解决什么问题

先建立直觉

给司机说“往前开”不算目的地。必须说去哪、几点前到、不能走哪条路,以及如何确认真的到了。

字段必须回答的问题听力导师示例
目标最终要改变什么?找出学生听错的主要机制
基线开始时是什么状态?10 题中错 7 题,3 题集中在弱读
成功条件什么证据表示完成?新材料中弱读题正确率达到 80%
约束什么不能做或不能超?不泄露未播放答案;分析不超过 30 秒
里程碑怎样知道仍在正确方向?先识别错因,再训练,再迁移测试
失败条件何时重试、改计划或问人?音频证据缺失时不猜,要求补充时间轴
目标与约束成功证据 生成计划步骤与依赖 执行一步产生新状态 比较目标差距完成/重排/升级 环境变化或进度不足:重规划
“行动很多”不是进度。只有新的可验证状态接近成功条件,才算真正推进。

优先级不是让模型凭感觉排队

当任务多于可用时间时,要先定义。一个实用版本可以同时考虑:影响、紧急度、依赖解锁价值、失败风险、用户偏好和预计成本。安全阻断项通常不参与普通加权,而是直接拥有最高级别。

优先级只是决策输入,不是永恒真理
score = 0.30*impact + 0.25*urgency + 0.20*unblocks
      + 0.15*user_preference - 0.10*cost

if safety_blocker: priority = CRITICAL
recalculate_when(deadline_changed or new_evidence or tool_failed)

常见误解

计划生成后按顺序执行到底,说明 Agent 很稳定。

实际上

真实环境会变化。稳定的系统会保存计划版本、持续监控前提,并在前提失效时重排,而不是执着于旧计划。

把愿望改成目标

20 分钟
  1. 把“帮我学好英语”改成可执行目标。
  2. 给出三个里程碑、两条约束和一个停止条件。
  3. 加入一个突发事件,说明哪些任务需要重新排序。
查看参考答案

例如:四周后在两套未见材料中把数字与弱读相关题正确率从 45% 提高到 75%;每周一套诊断和三次 15 分钟精听;不提前显示答案句;连续两周无提升则更换材料并请教师复核。

案例推演:把“做好新员工入职”变成可执行目标

一句模糊目标会让 Agent 不断发邮件和生成文档,却不知道何时完成。需要把结果、状态、依赖、优先级和停止条件写清。

本节追问:目标与待办清单的区别是什么? 先不要急着看结论。沿着下面四步,逐项区分输入、决策、证据和失败信号。

每一步都要回答:看到了什么?为何这样决定?怎样证明? 1 定义结果 将目标写成账号可用、培训完成、设备交付 观察 → 决策 → 留证据 2 建模依赖 合同生效后才能开账号,账号后才能培训 观察 → 决策 → 留证据 3 动态排序 按截止时间、风险和阻塞影响选择下一项 观察 → 决策 → 留证据 4 处理变化 入职日期改变时重算受影响分支 观察 → 决策 → 留证据 完整案例链:不是记住名词,而是能够用证据作出下一步决定
四步案例推演。手机上可左右滑动查看;每个箭头都代表一次需要证据支撑的状态转换。
阶段本步要做的决定什么算证据最常见的失败
定义结果将目标写成账号可用、培训完成、设备交付每项结果有可观察验收标准把“发欢迎邮件”当成最终结果
建模依赖合同生效后才能开账号,账号后才能培训依赖图无循环且阻塞原因可见按列表顺序执行而忽略前置条件
动态排序按截止时间、风险和阻塞影响选择下一项优先级变化有理由与记录永远先做最容易的任务
处理变化入职日期改变时重算受影响分支未受影响成果得到保留计划一变就全部推倒重来

阅读方式:先遮住后两列自己回答,再用“证据”和“失败”两列检查理解。

常见误解

让模型自己判断“差不多完成”

实际上

可观察症状:产出很多但关键账号仍未开通。

更可靠的修复:把目标转成状态机和验收谓词,由系统检查完成条件。

案例工作坊 · 建议真正动手完成

25 分钟
  1. 把入职目标写成五个可验证结果。
  2. 画出结果之间的依赖关系。
  3. 设计日期提前三天时的局部重规划。
查看参考答案

目标描述期望世界状态;计划只是到达该状态的当前假设。Agent 应围绕验收条件和依赖维护状态,环境变化时重规划而不是丢失目标。

迁移检查:换一个场景还会不会

以下哪项是更好的完成条件?