Agent 应该记住什么,又应该忘掉什么?
教学案例:登录超时任务中,“已经排除服务端配置”只服务本次排查;“完成前必须运行相关测试”可以是项目长期规则;“Diff 请简洁展示”可能是用户偏好。三者不该用同一种方式保存。
记忆不是把全部聊天永久存档,而是决定什么信息以后还要用、在哪个范围生效、何时过期、用户怎样纠正或删除。密钥永远不该进入普通文本记忆。
记忆是被选择、写入、读取、更新和遗忘的信息。准确性、时效性、来源、可见性和删除能力共同决定它是否值得信任。
什么信息值得跨任务留下?
项目规则、本轮约束和个人偏好不能混成一团。只有经过确认、写明来源与适用范围的信息才保存;以后召回时仍要允许用户纠正或删除。
- 1候选“这个项目使用 npm test”
来自项目文件,不因模型推断自动生效。
- 2确认检查来源与适用范围
这是项目规则,不是所有项目通用偏好。
- 3保存记录来源、范围、更新时间
敏感内容和一次性约束不进入长期记忆。
- 4召回只在当前项目相关任务中使用
界面说明本次使用了哪条记忆。
- 5更正或删除规则变化后立即失效
用户可以修改、仅本次忽略或彻底删除。
不保存:“这次先不改 API”只属于当前任务;API Key 和 `.env` 内容不进入普通文本记忆。
先分类型,再谈写入
显式项目规则通常比模型猜出的偏好可信,项目规则不能污染全局,临时排查状态应随任务结束,敏感凭证进入专用安全系统。每条记忆至少需要来源、作用范围和更新时间。
高影响长期记忆应让用户看见并确认。自动写入带来的便利必须和错误跨任务放大的风险一起评估。
官方事实查看这一结论的依据与边界+
Anthropic 文档说明 Claude Code 如何管理持久规则与记忆文件;这是 Claude Code 产品机制案例。
ANManage Claude's memory官方文档 · 核验 2026-07-14召回看质量,命中数量只是表象
相关记忆进入上下文前还要检查是否过期、是否与当前项目冲突、是否真的服务下一步。旧项目的 timeout 规则不能静默影响新仓库。
用户需要查看、编辑、删除和理解一条记忆何时被使用。纠正之后,旧值不能继续在隐藏缓存中生效。
官方事实查看这一结论的依据与边界+
Anthropic 文档区分人维护的持久指令、Auto Memory 与独立 Session,并说明它们作为上下文影响模型。
ANManage Claude's memory官方文档 · 核验 2026-07-14不要把 Session、搜索、压缩和 Memory 叫成一件事
Session 是完整任务记录;搜索是从过去记录里找原话;Compaction 为当前工作台腾位置;Memory 把少量信息带到未来任务。它们可以协作,但不是同一件事。
Hermes 与 Claude Code 的公开机制帮助我们核对这些区别。具体存储和检索实现属于各自产品,不要把它们泛化成行业统一做法。
官方事实查看这一结论的依据与边界+
Hermes 官方仓库文档说明 Session 保存在 SQLite,session_search 使用 FTS5 全文检索;这支持关键字检索事实,不支持把它描述为向量 RAG。
NOHermes Agent sessions官方源码 · 核验 2026-07-14有术语没听懂?在这里用人话再看一遍5 个词+
- 短期状态
- 服务当前任务、任务结束后通常不再需要的信息。
- 长期记忆
- 跨任务持久化并在未来条件满足时被检索的信息。
- 来源
- 一条记忆来自用户明确表达、项目文档、系统事实还是模型推断。
- 置信度
- 系统对推断信息正确程度的估计,不能替代用户确认。
- 错误命中
- 不相关、过期或错误记忆被召回并影响当前任务。
本章依据与证据边界2 条补充结论 · 7 份原始材料+
下面补充本章的其他依据,并说明每份材料能证明什么、不能证明什么。
- [4]
Anthropic 将 Compaction 和可写 Memory 目录作为两种不同的长任务上下文机制;前者压缩当前历史,后者把模型选择的信息外置持久化。
官方事实CLHarnessing Claude’s intelligence官方工程文章 · 核验 2026-07-14 - [5]
本站的 Memory 数据模型、TTL 与用户治理方案是跨产品教学推演。
本站推演ANManage Claude's memory官方文档 · 核验 2026-07-14
查看全部一手材料与源码证据 7 条
这份材料将 Context Engineering 定义为持续选择和维护推理时最合适的信息,而不只是改写一条 Prompt。它支持最小高信号上下文、按需检索、工具结果压缩、结构化笔记、Compaction 与 Subagent 隔离等长任务策略。
证据边界:官方经验与自测不能单独证明普遍收益,结论不得越过其样本、版本和适用范围。官方产品实现 · 核验 2026-07-23How Claude remembers your projectAnthropic这份文档区分由人维护的 CLAUDE.md 持久指令与由 Claude 写入的 Auto Memory,并描述它们的作用域、加载顺序、存储位置和容量边界。它强调这些内容会作为上下文影响模型,而不是不可绕过的技术策略,并支持用户检查、修改和删除记忆。
证据边界:官方文档不能单独证明未公开内部实现、长期可靠性或真实用户收益。固定提交源码 · 核验 2026-07-23Hermes Agent context compression and tool runtimeNous Research这份同提交文档解释 Hermes 如何区分稳定、上下文和易变 Prompt 层,并在压力下裁剪旧工具输出、保留边界、生成结构化摘要和修复工具调用配对。它支持课程讨论上下文压缩与缓存边界,不用来证明未在该文档中展开的工具运行时。
证据边界:固定提交只能证明该版本的公开实现,不能代表现行私有产品、真实任务质量或行业统一架构。官方产品实现 · 核验 2026-07-14Hermes Agent Persistent MemoryNous Research当前文档说明 Hermes 使用有字符上限的 MEMORY.md 与 USER.md、会话开始时冻结注入、写入审批、安全扫描,以及基于 FTS5 的 Session Search。
证据边界:可写 Memory 不等于事实正确、无限记忆、向量 RAG 或模型权重更新。官方产品实现 · 核验 2026-07-14Hermes Agent SessionsNous Research当前文档说明 Hermes 将完整消息与工具历史保存在 SQLite,会话可恢复和跨端检索,但恢复历史不等于把所有旧字节持续塞回模型上下文。
证据边界:持久会话不自动保证恢复无副作用,也不是隐私删除或长期语义记忆。官方产品实现 · 核验 2026-07-14Hermes Agent Skills SystemNous Research当前文档说明 Agent 可以创建、修改和删除 Skill,并通过 write_approval 将更改暂存供人工检查;Skill 被定义为按需加载的程序性记忆。
证据边界:Skill 自修改不等于方法必然改进,也不等于模型参数学习。官方产品实现 · 核验 2026-07-14Hermes Agent Context Compression and CachingNous Research当前文档公开工具结果裁剪、头尾保护、结构化摘要、重压缩和缓存策略,并说明摘要模型窗口不足时中段上下文可能在无摘要情况下被丢弃。
证据边界:Compaction 不能保证信息无损,也不是长期 Memory。