explore_rank_verify进阶约 80 分钟
9D
探索与发现:Agent 如何寻找“还不知道自己不知道什么”
参考:来源 F · 第 21 章
学完你能做到
- 区分执行、优化与开放探索
- 设计探索-利用平衡和停止条件
- 避免把大量搜索误当成专题研究
探索与普通搜索的区别
先建立直觉
按购物清单找商品是检索;在陌生市场里比较摊位、发现新品并修改清单,才是探索。
| 模式 | 已知什么 | 下一步怎样选 | 结束标准 |
|---|---|---|---|
| 执行 | 目标和路径大体明确 | 按依赖推进 | 成功条件满足 |
| 优化 | 候选空间已知 | 选择当前得分更高的方案 | 改进低于阈值 |
| 探索 | 候选和关键变量都不完整 | 优先减少最大不确定性 | 覆盖足够、边际收益低或预算耗尽 |
四个防止“研究越做越散”的停止条件
- 覆盖条件:预先规定的维度已经检查。
- 饱和条件:连续两轮没有出现新的高价值证据。
- 决策条件:现有证据已足以区分候选方案。
- 预算条件:时间或调用预算用尽,返回已知、未知与下一步。
设计一次听力专题研究
20 分钟- 围绕“学生为什么听不到答案句”提出至少三个竞争假设。
- 为每个假设设计一个能区分它们的小测试。
- 给出本次研究的停止条件和不能下结论的条件。
案例推演:专题研究如何发现自己还漏了什么
研究“远程办公是否提高生产率”时,最先找到的资料可能集中于科技公司和自愿参与者。只总结已知材料会放大样本偏差,探索必须主动寻找反例和空白。
本节追问:研究型 Agent 怎样从“收集更多”升级为“减少关键未知”? 先不要急着看结论。沿着下面四步,逐项区分输入、决策、证据和失败信号。
| 阶段 | 本步要做的决定 | 什么算证据 | 最常见的失败 |
|---|---|---|---|
| 建立问题图 | 拆出人群、任务、时间尺度和结果指标 | 每个节点都有当前证据与未知 | 只用一个宽泛搜索词 |
| 提出假设 | 为正向、负向和条件效应写可证伪预测 | 不同假设需要不同证据区分 | 先认定结论再找支持材料 |
| 定向探索 | 优先查询证据薄弱或冲突最大的节点 | 每次搜索有预期信息增益 | 按搜索排名顺序机械下载 |
| 更新边界 | 记录哪些结论可说、不可说和仍缺什么 | 报告包含证据覆盖与未决问题 | 用资料数量冒充研究完整度 |
阅读方式:先遮住后两列自己回答,再用“证据”和“失败”两列检查理解。
常见误解
让 Agent 不断搜索直到预算耗尽
实际上
可观察症状:新增资料高度重复,关键反例仍未覆盖。
更可靠的修复:维护证据矩阵,按边际信息增益和停止规则选择下一步。
案例工作坊 · 建议真正动手完成
25 分钟- 画出远程办公问题图的四个维度。
- 写出一个支持假设和一个反假设及区分证据。
- 定义“继续搜索不再值得”的停止标准。
查看参考答案
探索的目标不是最大化链接数,而是系统性减少对结论影响最大的未知。问题图、竞争假设、证据矩阵和停止规则共同提供方向。
迁移检查:换一个场景还会不会
哪种新资料的信息增益通常最高?