智能体入门课
explore_rank_verify进阶80 分钟

9D

探索与发现:Agent 如何寻找“还不知道自己不知道什么”

参考:来源 F · 第 21 章

学完你能做到

  • 区分执行、优化与开放探索
  • 设计探索-利用平衡和停止条件
  • 避免把大量搜索误当成专题研究

探索与普通搜索的区别

先建立直觉

按购物清单找商品是检索;在陌生市场里比较摊位、发现新品并修改清单,才是探索。

定义探索空间问题·边界·预算 生成多样假设包含相反解释 主动找证据支持与反证 排序并淘汰价值·置信度·成本 关键不确定性仍高:生成下一轮问题 停止条件覆盖/收益/预算
专题研究不是“搜十次后总结”,而是让证据不断改变假设,再用验证收敛。
模式已知什么下一步怎样选结束标准
执行目标和路径大体明确按依赖推进成功条件满足
优化候选空间已知选择当前得分更高的方案改进低于阈值
探索候选和关键变量都不完整优先减少最大不确定性覆盖足够、边际收益低或预算耗尽

四个防止“研究越做越散”的停止条件

  1. 覆盖条件:预先规定的维度已经检查。
  2. 饱和条件:连续两轮没有出现新的高价值证据。
  3. 决策条件:现有证据已足以区分候选方案。
  4. 预算条件:时间或调用预算用尽,返回已知、未知与下一步。

设计一次听力专题研究

20 分钟
  1. 围绕“学生为什么听不到答案句”提出至少三个竞争假设。
  2. 为每个假设设计一个能区分它们的小测试。
  3. 给出本次研究的停止条件和不能下结论的条件。

案例推演:专题研究如何发现自己还漏了什么

研究“远程办公是否提高生产率”时,最先找到的资料可能集中于科技公司和自愿参与者。只总结已知材料会放大样本偏差,探索必须主动寻找反例和空白。

本节追问:研究型 Agent 怎样从“收集更多”升级为“减少关键未知”? 先不要急着看结论。沿着下面四步,逐项区分输入、决策、证据和失败信号。

每一步都要回答:看到了什么?为何这样决定?怎样证明? 1 建立问题图 拆出人群、任务、时间尺度和结果指标 观察 → 决策 → 留证据 2 提出假设 为正向、负向和条件效应写可证伪预测 观察 → 决策 → 留证据 3 定向探索 优先查询证据薄弱或冲突最大的节点 观察 → 决策 → 留证据 4 更新边界 记录哪些结论可说、不可说和仍缺什么 观察 → 决策 → 留证据 完整案例链:不是记住名词,而是能够用证据作出下一步决定
四步案例推演。手机上可左右滑动查看;每个箭头都代表一次需要证据支撑的状态转换。
阶段本步要做的决定什么算证据最常见的失败
建立问题图拆出人群、任务、时间尺度和结果指标每个节点都有当前证据与未知只用一个宽泛搜索词
提出假设为正向、负向和条件效应写可证伪预测不同假设需要不同证据区分先认定结论再找支持材料
定向探索优先查询证据薄弱或冲突最大的节点每次搜索有预期信息增益按搜索排名顺序机械下载
更新边界记录哪些结论可说、不可说和仍缺什么报告包含证据覆盖与未决问题用资料数量冒充研究完整度

阅读方式:先遮住后两列自己回答,再用“证据”和“失败”两列检查理解。

常见误解

让 Agent 不断搜索直到预算耗尽

实际上

可观察症状:新增资料高度重复,关键反例仍未覆盖。

更可靠的修复:维护证据矩阵,按边际信息增益和停止规则选择下一步。

案例工作坊 · 建议真正动手完成

25 分钟
  1. 画出远程办公问题图的四个维度。
  2. 写出一个支持假设和一个反假设及区分证据。
  3. 定义“继续搜索不再值得”的停止标准。
查看参考答案

探索的目标不是最大化链接数,而是系统性减少对结论影响最大的未知。问题图、竞争假设、证据矩阵和停止规则共同提供方向。

迁移检查:换一个场景还会不会

哪种新资料的信息增益通常最高?