每日 Harness 开源 · Source
返回本期 · Back to 2026-06-11

论文 · Papers2026-06-11 · Thursday, June 11, 2026

SearchSwarm: Towards Delegation Intelligence in Agentic LLMs for Long-Horizon Deep Research

arxiv.org原文 ↗

SearchSwarm: Towards Delegation Intelligence in Agentic LLMs for Long-Horizon Deep Research
SearchSwarm 把“会不会委派”当成模型能力训练,而不是只靠外部 orchestrator。作者先用 harness 生成包含正确分解、派发、回传约束的深度研究轨迹,再做监督微调;SearchSwarm-30B-A3B 在 BrowseComp 得 68.1、BrowseComp-ZH 得 73.3,说明委派策略本身可以进入模型权重。
浏览

评论 · Comments