每日 Harness 开源 · Source
返回本期 · Back to 2026-08-30

博客文章 · Blog Posts2026-08-30 · Sunday, August 30, 2026

I accidentally turned LLM memory into program analysis

pwning.systems原文 ↗

I accidentally turned LLM memory into program analysis
Lemmalog 让 LLM 把自然语言和调试观察抽成事实,再用 Datalog 做规则推导、撤回、时间区间和 provenance,因此一条被推翻的观察会自动使下游结论失效。LongMemEval 的三次运行 F1 为 0.463±0.010(full context 为 0.222),回答上下文约缩小 38 倍;LoCoMo 得分 0.533,低于 PropMem,说明实体抽取和模糊推理仍不能交给符号层。
–浏览

评论 · Comments