0
历史记录能帮 Agent 想起过去,却不能保证它下一次真的会按正确方法做。MSCE 想补上的,正是“记得”和“会做”之间的这段空白。
算法上的分工 L1 先把每一步变成可追溯证据; L2 要跨 episode、过价值阈值,才形成可修订策略; L3 只从多条稳定策略里抽环境规律。 后面的技能不是从“记忆很多”里长出来的,而是从这三道筛选里长出来的。
举报
如果把聊天记录、工具返回和操作轨迹都塞进长期记忆,Agent 的确“记得更多”了。
本版积分规则 发表回复 回帖后跳转到最后一页