研究发现AI代理可通过持久化文件传播提示注入攻击

Anthropic与EPFL研究人员联合发现,AI代理可通过持久化文件实现提示注入攻击的跨会话传播。研究显示,SOUL.md、MEMORY.md等文件在上下文重置后仍能保留恶意载荷,使攻击能够从一个代理会话传播到另一个会话。测试中,攻击者将载荷伪装成“整理共享机器”的任务,成功诱导Claude Haiku 4.5代理删除SSH密钥。研究人员警告称这种攻击方式对多代理系统和长期运行的任务构成严重威胁。🔗 原文链接:https://x.com/XavierRiveraX/status/2089736915448668210

© 版权声明
THE END
喜欢就支持一下吧
点赞0 分享
相关推荐
  • 暂无相关文章