The Memory Trust Gap: Capability-Dependent Failures in Persistent-Memory Agents
arxiv.org原文 ↗
这项工作把持久记忆的风险定义为“陈旧事实压过当前权威证据”,并在 Qwen3 0.6B、1.7B、4B、8B 同族模型上拆分 Benefit 与 Safety 两套动作评分任务。Benefit 套件中模型 92% - 100% 选择旧值;Safety 套件里,较大模型在把旧日期伪装成新信息时反而坍塌得更厉害。作者还在 Llama 系列和 RGB、MisBench 上复现尺度交互,说明记忆元数据的补丁不能代替冲突消解。
–浏览
评论 · Comments