所有文章
阅读时长 2 分钟
别把上下文窗口,当成 Agent 的记忆
上下文会满、会贵,也会在下一轮消失。真正能长期工作的 Agent,得把眼前正在想的事和需要长期保存的事分开。
上下文窗口是一次推理的工作区,不是可靠的长期记忆。把聊天记录全部塞回模型,会同时带来成本上升、旧信息干扰和隐私范围扩大。
把记忆分成三层
当前步骤和工具结果属于工作记忆;用户明确确认的偏好属于长期记忆;文档和数据库仍是外部事实源。三者要有不同的保存时间和访问权限,不能混成一段摘要。
写入比读取更严格
只有可复用、稳定且获得授权的信息才写入。为每条长期记忆保留来源、创建时间、最近确认时间和删除入口;推断出的性格或敏感属性默认不保存。
检索后仍要验证
取回的记忆只是候选上下文。遇到地址、权限、价格和身份等会变化的信息,要回到权威数据源确认;冲突时优先使用更新且来源更明确的记录。
上线前检查
- 用户能查看和删除长期记忆
- 过期记录不会静默覆盖当前事实
- 同一任务可在不加载完整历史的情况下完成