Bad Memory: Evaluating Prompt Injection Risks from Memory in Agentic Systems
arxiv.org原文 ↗
论文把 prompt injection 风险从当前输入扩展到持久化状态,讨论 memory files、行为偏好和知识库如何携带恶意指令。关键事实是攻击内容可以跨会话保留,并在未来任务里影响 agent 行为。它把 agent 安全边界重新画到记忆写入、读取和信任标注上,而不是只盯用户最新消息。
–浏览
评论 · Comments