《凡人修仙传》官方动画
536 字
1 分钟
Agent Memory 的工程边界:工作记忆、长期记忆与知识
“给 Agent 加记忆”常被简化为把历史消息写进向量数据库。这样做可以产生熟悉感,却不一定产生可靠的长期状态。
三个不同问题
工作记忆服务于当前任务。它保存计划、短期变量、未完成事项和最近的工具证据,生命周期通常和一次运行或会话一致。
长期记忆保存跨会话仍有价值的偏好、决策与经验。它需要稳定身份、来源、过期策略和删除能力。
知识回答“依据是什么”。它更强调来源快照、引用、版本和人工审阅,不应该被模型在后台静默改写。
| 层次 | 典型内容 | 写入方式 | 主要风险 |
|---|---|---|---|
| Context | 当前消息与工具结果 | Harness 投影 | 膨胀与噪声 |
| Working Memory | 计划、变量、待办 | 运行时受控写入 | 状态漂移 |
| Durable Memory | 偏好、长期决策 | 显式批准或规则 | 错误固化 |
| Knowledge | 来源、事实、引用 | 摄取与审阅流程 | 来源丢失 |
写入比检索更危险
检索失败通常只影响一次回答,错误写入会污染后续所有会话。因此长期记忆的关键不是“召回率”,而是写入资格:
- 这条信息是否有稳定主体?
- 它来自用户明确表达,还是模型推断?
- 是否需要用户批准?
- 什么时候过期?
- 如何删除和追踪使用记录?
SAGE 将原始来源、知识提案和已批准知识分离,就是为了让模型可以提出候选,但不能把候选直接变成事实。
工程上如何表达清楚
谈“Agent Memory 怎么设计”时,不要停在向量数据库。先区分 Context、Working Memory、Durable Memory 和 Knowledge,再说明每一层的生命周期、写入门禁与恢复方式。工程判断往往比组件名称更重要。
分享
如果这篇文章对你有帮助,欢迎分享给更多人!
Agent Memory 的工程边界:工作记忆、长期记忆与知识
https://blog.sagecompanion.top/posts/agent-memory-boundaries/ 部分信息可能已经过时
相关文章 智能推荐
1
Agent 生产化的最小闭环:浏览器、Skill 与文件如何接起来
agent 从 Claude Platform 的 Computer Use、Browser Use、Skills API 和 Files API 出发,拆解生产 Agent 的输入、方法、执行、交付与隔离边界。
2
评测不是打分:SAGE 的 Context、Memory、RAG、Harness 怎么量
agent Agent 的评测难在能力和控制纠缠在一起。以 SAGE 为例,讨论 Context、Memory、RAG、Harness 四层各自该评什么,以及如何用契约层和智能层的交叉标签让结果因果可解释。
3
指标变好了,但默认没开:SAGE RAG 的几个工程取舍
agent 把 PostgreSQL 全文检索 + 精确向量 + RRF 接进 SAGE,并在同一协议下比较 FastEmbed、百炼和豆包后,百炼在冻结测试把 Recall@10 从 0.889 提到 1.000。但它仍然默认关闭。记录这次 RAG 工程化里几个由证据而不是技术标签决定的取舍。
4
SAGE:让问题成为可以持续生长的证据
agent SAGE 为什么不只是另一个聊天框,以及目标、知识、实践和证据如何形成可恢复的学习闭环。
5
当模型不再需要手把手:Claude 5 与无状态 MCP 带来的 Agent 工程变化
agent Claude Code 为新模型删掉了 80% 以上的系统提示词,MCP 也从有状态双向协议转向无状态请求。解释 round-robin、JSON-RPC、SSE 与 MRTR,并讨论 Agent 工程的复杂性究竟去了哪里。