Learning What to Remember
arxiv.org原文 ↗
这篇论文把 agent memory 的“该忘什么”建模为 consolidation-time 价值估计,而不是查询时相似度。作者用 emotional intensity、goal relevance、value alignment、self/user relevance、task utility、reliability、usage history 七个因素学习线性权重;LongMemEval blind regime 中保留 gold evidence 达 0.770±0.011,高于 uniform 0.657、最佳单因素 0.518 和 recency 0.368。它的贡献在于明确区分遗忘决策和检索决策,并把权重解释性保留下来。
–浏览
评论 · Comments