4 话一屏看完
点任意一格跳到下方「干货解读」看 punchline。
第 01 话 · feature
存 ≠ 学
保存 100 条轨迹 ≠ Agent 真的学会
第 02 话
先验证 再学习
三层验证:结果 / 过程 / 质量
第 03 话
经验写哪里
看性质 = 选载体:知识 / Prompt / 程序 / 参数
第 04 话
持续进化 = 双循环 + 睡眠学习
在线跑 + 记 / 离线改 + 验
把 100 条轨迹堆进上下文 ≠ Agent 真学会。必须评价、对照、归纳、验证,缺一不可。原始轨迹是有用信号,但信号本身不是学习。
学之前先验证:环境结果(代码通过?) → 过程(动作合规?) → 质量(语言自然?)。删除失败测试也能让测试通过——结果对不等于过程对。
经验写哪里看性质:事实 → 知识库(可检索)/ 判断原则 → Prompt(可解释)/ 硬约束 → 程序(可测试)/ 高维能力 → 参数(可泛化)。同一条经验可能要走多个载体。
在线 Agent 只管跑 + 记证据,离线 Agent 才改 Prompt/Skill/参数;睡眠学习 = 后台整合 + 修剪。章 3 记忆 + 章 8 进化 = 完整闭环。