跳转至

MemLineage: Lineage-Guided Memory Enforcement — arXiv:2605.14421

摘要

MemLineage 是一种 LLM Agent 记忆防御框架,为每条记忆条目附加加密溯源和 LLM 介导的派生世系信息。近期研究表明,不可信内容可被写入持久 Agent 状态并在后续会话中作为指令重新进入——核心系统问题是:如何在保留有用记忆召回能力的同时,防止此类状态引导敏感行为。MemLineage 将此问题视为证据链(chain-of-custody)问题,通过追踪记忆条目的来源和派生路径来实现可验证的记忆治理。

核心贡献

  1. 加密溯源机制:为每条记忆条目附加加密签名,追踪其原始来源(用户输入、外部工具返回、Agent 自生成)。
  2. 派生世系追踪:记录记忆条目如何被 LLM 处理、组合、修改的完整链路,支持事后审计。
  3. 敏感操作门控:基于记忆条目溯源信息,动态决定是否允许特定操作(如执行代码、访问 API)。
  4. 可验证记忆召回:在召回记忆时同时提供可信度证明,确保记忆内容可被验证而非单纯依赖 LLM 内部状态。

为什么重要

随着 Agent 越来越多地处理敏感信息(邮件、日历、财务记录),记忆系统的安全性变得至关重要。MemLineage 首次将区块链式的溯源机制引入 Agent 记忆,为记忆的内容治理和操作审计提供了坚实基础,对构建可信 Agent 系统具有重要参考价值。

与移动端/端侧的相关性

端侧 Agent 直接访问用户设备上的敏感数据(照片、消息、位置),记忆溯源和门控机制可确保即使设备丢失或被攻击,记忆中的敏感信息也不会被恶意利用。轻量级加密方案(如 HMAC)可在端侧高效实现。