Agent Memory Poisoning(记忆投毒)
别名:记忆投毒Agent记忆攻击记忆污染Memory Poisoning
| 分类 | 🛡️ 安全风险 |
| 阅读时间 | ⏱️ 19 分钟 |
| 更新时间 | 📅 2026-06-30 |
| 条目编号 | ENC-SECURITY-03-memory-poisoning |
Agent Memory Poisoning 是一种针对 Agent 记忆系统的攻击方式。攻击者通过构造特定输入,向 Agent 的长期记忆中注入虚假或恶意信息,这些信息会在后续对话中被 Agent 当作事实使用。
关键要点 ✦
- 94% 的生产级 Agent 可被记忆投毒攻击(斯坦福/MIT 2026 联合研究)
- 记忆投毒比 Prompt Injection 更隐蔽:恶意信息在记忆中持久化
- 攻击可导致 Agent 长期输出错误信息或执行攻击者的指令
- 三层记忆架构(会话/工作/长期)各层都可能被污染
- 防御措施:记忆加密签名、写入审计、定期记忆消毒
详细解释
Agent Memory Poisoning(记忆投毒)是 2026 年最受关注的 Agent 安全威胁之一。攻击者通过向 Agent 的记忆系统注入虚假或恶意信息,使 Agent 在后续所有对话中将错误信息当作事实来使用。
与 Prompt Injection 相比,记忆投毒更加隐蔽和持久——恶意信息一旦写入 Agent 的长期记忆,可以在无数次对话中持续影响 Agent 的行为,直到被清理。
攻击案例
2026 年斯坦福/MIT/NVIDIA 联合研究发现:94% 的生产级 Agent 可被记忆投毒攻击。典型的攻击路径:攻击者发送一条包含虚假信息的消息→Agent 将其存储到长期记忆→后续对话中 Agent 引用这些虚假信息作为"已知事实"→导致错误决策。
防御方案
记忆加密签名:为每条记忆条目附加加密签名,防止篡改。
写入审计:记录所有记忆写入操作,发现异常时触发告警。
定期记忆消毒:周期性审查长期记忆中的信息,清除可疑条目。
源可信度评估:根据信息来源的可信度决定是否写入长期记忆。
📖 相关条目
🛠️ 相关产品
🏷️ 标签记忆投毒安全Agent记忆系统攻击