MemoHarness: Agent Harnesses That Learn from Experience
arxiv.org原文 ↗
MemoHarness 把 agent harness 视为可编辑的外部控制层,而不是固定脚手架;这个层负责上下文、工具、编排、记忆、解码和输出处理。它用 Replay、Reflect、Revise、Validate 四阶段循环在六个控制维度上修改 harness,并在浏览器、数据库和知识密集问答任务上优于未修改的 DSPy、LangGraph 与 TextGrad harness。论文的技术看点在于让基础模型诊断并修补控制逻辑,而不只调 prompt。
–浏览
评论 · Comments