Agent 长期记忆治理:写入理由、来源与删除必须同时存在

Agent 长期记忆治理:写入理由、来源与删除必须同时存在原创封面

先区分记忆类型再谈长期保存

一次旅行目的地是临时任务事实,不应自动升级为长期偏好。事实、偏好、任务状态和会话摘要具有不同寿命、证据要求与访问范围,混在一个向量库里会让旧信息在不相关场景中被召回。长期记忆设计先建立类型边界:事实可被新证据推翻,偏好需用户表达稳定倾向,任务状态在完成后过期,摘要只是压缩表示而非权威原文。

每条记录包含主体、类型、规范值、来源引用、创建理由、置信度、用途范围、到期策略和派生关系。来源必须能区分用户明确陈述、工具观察与模型推断;模型推断默认不能获得与用户确认相同的权重。没有来源或无法说明未来用途的内容不进入长期存储,而不是先保存再期待清理任务兜底。

存储区可以共享基础设施,但授权与检索策略需逻辑隔离。任务执行器只能读取当前任务需要的状态,推荐器读取经许可的偏好,审计查看元数据而非正文。将所有历史对话作为“记忆”既增加噪声,也扩大隐私面;原始会话保留期和长期记忆生命周期应独立定义。

写入门槛由稳定收益决定

写入前要回答信息是否可能在未来多次稳定改善任务、用户是否预期被记住、错误记忆会造成什么损失。餐饮过敏可能有长期价值但高度敏感,需要明确选择;本次航班日期很快失效,只属于任务状态;用户随口称赞一种颜色也不足以建立偏好。以保存数量或召回率作为目标,会鼓励系统收集低价值事实。

模型提出候选记忆后,确定性策略检查类别、敏感度、来源和用途。高敏类别默认拒绝长期写入,允许保存时采用明确同意、最小字段和短期限。工具返回的第三方信息不能自动写成用户事实,网页内容也不能借提示注入要求系统记住某个指令。写入服务独立授权,模型没有绕过策略的直接数据库权限。

重复候选先与现有记录按主体和语义键比对。等价信息更新最近证据时间而非生成无数副本;细节不同则保留版本和冲突状态,等待澄清。不能因为新陈述更流畅就覆盖旧的高质量来源。每次写入决定记录规则版本与简短理由,使用户和维护者能理解为何这条内容存在。

冲突处理不让模型自行抬高置信度

当用户先说喜欢安静房间,后来为一次团体活动选择热闹区域,两条信息未必互相否定。冲突判定需要考虑时间、作用域和来源,长期偏好可保留为“通常偏好安静”,本次任务选择只覆盖当前行程。模型不能把一次行为观察提升为稳定事实,也不能在没有新证据时修改置信度。

真正冲突时保留双方证据和有效时间,将记录标为待确认或降低读取优先级。需要决定的任务可向用户提出最小澄清,而不是随机选择最近一条。纠正操作创建新版本并使旧版本退出在线召回,同时保留必要审计链;展示给用户的界面应说明来源和使用场景,方便纠正错误归因。

置信度更新使用明确规则,例如用户直接确认高于单次行为推断,多次独立一致证据才逐步提高。来源被删除或过期时,派生置信度重新计算。避免用模型自报的百分数作为统计置信度,因为它难以校准,也可能被提示内容操纵。

读取前按目的与调用者过滤

召回查询除了语义相似度,还必须包含主体、用途、记忆类型、有效期、敏感权限和当前任务范围。家庭账户尤其不能只按共享会话检索,成员偏好需要明确所有者和共享标志。工具调用若只需要配送城市,就不应同时取得健康信息或完整旅行历史;最小化返回字段也降低恶意工具输出窃取上下文的机会。

召回结果进入提示时携带来源、时间和置信度,并明确它是可纠正背景而非系统指令。过期任务状态、冲突记录和待删除内容在检索层直接排除,不能寄望模型忽略。对于会造成金额、医疗或访问控制影响的决定,长期记忆只可作为候选,仍需当前事实或用户确认。

读取审计记录哪个服务以何用途使用了哪些记忆标识,但不复制内容。异常大范围查询、跨主体访问和敏感类型读取触发告警。若下游第三方工具需要某个偏好,传递前重新检查用户授权和字段必要性,并标明不可二次保留,尽管最终还需依靠合同与技术隔离执行。

删除沿索引、缓存和派生物传播

删除不能只移除主表一行。记忆可能存在于向量索引、关键词索引、缓存、离线特征、会话摘要和推荐结果中,需要用派生关系图定位副本。删除请求生成操作标识,逐个系统记录完成状态;在线检索在请求开始后立即用墓碑过滤,即使后台物理清理尚未完成,也不能再次返回该内容。

派生摘要若混合多条来源,不能简单删除整段或假装不受影响。系统应保存摘要到来源的依赖关系,重新生成不含目标内容的版本;无法可靠分离时使摘要失效。向量库删除后还要查询验证,避免异步索引仍返回旧向量。缓存键必须能按记忆标识失效,而不是等待漫长自然过期。

备份有独立保留与恢复风险。可在备份中保留受控加密数据至法定期限,但恢复流程必须重新应用删除清单,不能让已删除内容回到在线系统。删除日志记录范围、状态和时间,不保留被删除正文。用户界面显示在线系统已清除、备份到期策略以及仍需处理的异常,而不是过早宣称永久消失。

周期治理处理过期与低价值记录

任务完成后,执行状态按策略快速过期;偏好长期未使用可降低置信度或请求复核;失去主体或来源的孤立记录进入清理。周期作业先生成候选,再依据类型和合规策略删除或归档,避免单一固定天数错误处理所有内容。清理本身幂等,并记录规则版本与数量,不把正文输出到作业日志。

价值评估不能仅看调用次数,因为一次敏感记忆即使常被误召回也不应因此保留。应结合未来用途、用户选择、准确性、敏感度和错误影响。长期未验证且可能造成错误个性化的信息适合降权或删除。系统还要检查没有来源、置信度异常升高和跨主体引用的记录,这些往往暴露写入策略缺陷。

治理规则变化时运行影响分析,统计哪些类型将提前到期或需要重新征求同意。大规模清理先在影子模式生成清单并抽样验证,再分批执行,避免错误规则一次删除所有有效偏好。恢复只能针对明确批次和加密快照,并再次遵守随后发生的用户删除请求。

用完整生命周期而非召回率验收

测试从写入开始:一次性地点不能成为长期偏好,敏感候选无同意不落库,模型推断不能冒充用户陈述。冲突场景验证证据被保留且置信度按规则变化。读取测试使用两个租户、家庭成员和不同用途,确保过滤发生在检索层,过期与冲突内容不会进入提示。

删除测试逐项查询主存储、关键词索引、向量索引、缓存和派生摘要,任何在线路径都不得再命中;模拟从旧备份恢复后,删除清单必须重新应用。访问审计只包含标识和用途,扫描日志确认没有敏感内容副本。时钟测试覆盖到期边界与清理作业重复运行。

产品验收还需让用户查看来源、创建理由、有效期并能纠正或删除。指标观察错误召回、冲突率、删除传播时延和孤立记录,而不是追求记忆越多越好。只有写入有理由、读取受目的限制、冲突有证据、到期会退出且删除能传遍派生系统,长期记忆才是一项可治理能力。

派生摘要需要可逆的来源图

为了节省上下文,系统常把多条记忆压成摘要,但摘要若没有逐项来源,就无法在某条事实过期或删除时修正。生成摘要时保存参与记录、版本、生成器版本和每个结论的来源集合;读取摘要仍应用原记忆的最严格用途与敏感策略,不能因压缩而获得更宽权限。

来源冲突或置信度变化会使摘要失效,后台按依赖图重新生成,而不是在旧文本上做字符串删除。无法定位来源的历史摘要只能退出在线召回。新摘要与旧摘要并存切换时采用版本指针,避免会话同时读到两个相互矛盾的压缩结果。

测试删除一条同时参与多个摘要的记忆,确认所有派生物被更新且不残留可推断细节;再修改用途授权,摘要检索立即收窄。派生关系完整,用户的纠正和删除才不会停在主表。

实现片段

type Memory = { sourceId: string; purpose: string; expiresAt?: Date }

一手参考资料

评论 · 0

还没有评论留下第一句经过思考的话。

游客评论需审核。注册后可直接公开,无需审核。

SHARE / 分享

分享这篇文章

WECHAT / 微信

用微信扫一扫

在手机微信中打开文章后,再从微信右上角分享给朋友或朋友圈。