每日 Harness 开源 · Source
返回本期 · Back to 2026-07-01

论文 · Papers2026-07-01 · Wednesday, July 1, 2026

Recursive Self-Evolving Agents via Held-Out Selection

arxiv.org原文 ↗

Recursive Self-Evolving Agents via Held-Out Selection
论文比较的是不更新权重、只演化自然语言 artifact 的 self-evolving agent:reflection、workflow、playbook、cheatsheet 或优化 prompt 都属于这类条件化材料。作者指出许多结果只在同一个 benchmark 上报告收益,因此引入 held-out selection 来检验 artifact 是否跨任务泛化。它的主要价值是把 prompt/artifact 演化拉回到训练-验证分离的评测纪律中,而不是把单点 benchmark 提升当成 agent 能力增长。
浏览

评论 · Comments