L10 练习
练习 1:量化增量简报 vs 全量报告的效率(设计实验类)
本课的增量简报说"不从头重写"。设计实验量化:
- 对比: - 全量模式:每次运行写完整报告(第 5 次也是从头写) - 增量模式:只写本次新增/修正(第 5 次只写 diff)
- 指标: - token 消耗(增量应远少于全量) - 读者获取新信息的效率(增量一眼看出新东西) - 信息完整性(增量会不会漏掉重要的旧结论)
- 跑 5 次模拟运行,对比两种模式的指标。
验收:增量模式 token 消耗 < 全量的 30%,且新信息可读性更高。诚实标注:增量模式要求读者读过历史简报,首次读者可能需要全量。
练习 2:实现动态 TODO 的优先级
本课的 TODO 是平的(无优先级)。改进:
- 给每个 TODO 加 priority 字段(high/medium/low)。
- next_actions 按优先级排序返回。
- 优先级可动态调整:发现新线索 → 相关 TODO 升优先级。
验收:next_actions 返回有序列表(high 优先)。面试能讲清"不是所有 TODO 一样重要,要排序"。
练习 3:把 TaskLedger 接入 graph
本课手写了 TaskLedger 但没接入 graph。改进:
- graph 入口加「读账本→决定本次范围」节点(config.enable_ledger)。
- research_team 调 next_actions 决定查什么(而非每次 split)。
- writer 根据 output_mode 产出全量报告或增量简报。
验收:开启 ledger 后,第二次运行走 next_actions 决定查什么,产出增量简报。思考:这需要改 state.py 吗?(提示:可能要加 ledger_topic 字段)。