Memory as an Attack Surface in LLM Agents
arxiv.org原文 ↗
论文把 agent memory 明确列为攻击面:记忆提升个性化和上下文连续性,也会把攻击者植入的信息持久保存下来。摘要中的实验场景涉及多项选择问答,说明污染不一定需要改工具或越权 API,只要影响后续推理上下文就能改变答案。这个视角把 prompt injection 从一次性输入问题推进到跨会话状态安全。
–浏览
arxiv.org原文 ↗
评论 · Comments