🧠 图解记忆:Reflexion = 带记忆的反思(跨任务学习);点击图片可查看原图。
💡 答案要点
Reflexion = 带记忆的反思(跨任务学习)
普通反思(单任务内):
Task1: 生成 → 反思(失败) → 修正 → 成功
问题:Task2 的失败教训无法传递给 Task3
Reflexion(跨任务记忆):
Task1: 生成 → 反思(失败) → 修正 → 成功 → 存入记忆
Task2: 生成 → 检索记忆 → 发现Task1相关经验 → 避免重蹈覆辙Reflexion 三步循环:
- Act(行动):Agent 尝试执行任务
- Evaluate(评估):外部 Evaluator 打分
- Reflect(反思):
- 失败 → 生成语言反思存入记忆
- 成功 → 也存入(记录成功路径)
- 下次遇到类似任务 → 检索记忆避免重蹈覆辙
面试话术:
"Reflexion 把环境反馈整理成语言形式的反思,并在后续尝试中作为记忆使用。它不是参数更新,也不天然跨所有任务泛化;记忆可能过时或把错误经验带入新任务,因此需要作用域、检索、去重、失效和效果评估。"
📚 参考:Reflexion: Language Agents with Verbal Reinforcement Learning(原论文)
