每日 Harness 开源 · Source
返回本期 · Back to 2026-07-04

论文 · Papers2026-07-04 · Saturday, July 4, 2026

ReContext: Recursive Evidence Replay as LLM Harness for Long-Context Reasoning

arxiv.org原文 ↗

ReContext: Recursive Evidence Replay as LLM Harness for Long-Context Reasoning
ReContext 提出 recursive evidence replay,用 harness 反复检查模型是否真正利用长上下文中已给出的证据。它关注的不是扩大 context window,而是追踪模型在长文档中是否回到关键证据并保持推理一致。这个问题在法律、审计、研究综述和复杂客服场景都很具体:答案看似合理并不等于证据链被正确使用。
浏览

评论 · Comments