I accidentally turned LLM memory into program analysis
pwning.systems原文 ↗
Lemmalog 让 LLM 把自然语言和调试观察抽成事实,再用 Datalog 做规则推导、撤回、时间区间和 provenance,因此一条被推翻的观察会自动使下游结论失效。LongMemEval 的三次运行 F1 为 0.463±0.010(full context 为 0.222),回答上下文约缩小 38 倍;LoCoMo 得分 0.533,低于 PropMem,说明实体抽取和模糊推理仍不能交给符号层。
–浏览
评论 · Comments