Compact-Memory LLM Agents via Online Max-Member Clustering and Atom-Aware Packing
arxiv.org原文 ↗
RSM-full 以余弦门控的 max-member merge 控制写入,以 atom-aware packer 组织读取,把“保留哪些记忆”和“如何装入窗口”作为一体化设计。AMA-Bench 的 4k 预算达到完整上下文 83% 质量、token 成本 32%;在约 2.6k - 5k 区间比 Online K-Means 高 3.5 - 6.0 个百分点(四种子,p<.001),是针对紧凑预算的实测 Pareto 点。
–浏览
评论 · Comments