每日 Harness 开源 · Source
返回本期 · Back to 2026-08-26

论文 · Papers2026-08-26 · Wednesday, August 26, 2026

Disagree to Explore, Agree to Converge: Adaptive MoE Routing for Test-Time Agentic Coding

arxiv.org原文 ↗

Disagree to Explore, Agree to Converge: Adaptive MoE Routing for Test-Time Agentic Coding
Risa 读取 MoE 的原生路由轨迹:专家意见分散时继续探索,路由趋同时收束,并用同一信号挑选补丁,不另接裁判或把测试结果当选择器。SWE-bench Verified 上,gpt-oss 的宏观解决率从 44.9% 增至 48.2%,策略还能迁移到 Qwen3.6 的完整 500 题。它将本来只是稀疏计算调度的内部信号,转化为自适应测试时预算,前提是模型暴露足够细的路由信息。
–浏览

评论 · Comments