每日 Harness 开源 · Source
返回本期 · Back to 2026-08-21

论文 · Papers2026-08-21 · Friday, August 21, 2026

Task-Conditioned Least-Privilege Learning for Executable Terminal and MCP Agents

arxiv.org原文 ↗

Task-Conditioned Least-Privilege Learning for Executable Terminal and MCP Agents
方法在每个工具动作前后做六维确定性审计,把任务所需充分权限包与实际轨迹比较,再将超额权限作为后训练目标。Qwen3.5-4B 在 1,500 个任务上训练后,2,896 个回合的安全成功率从 64.36% 提到 98.48%,超额权限事件由 4.56% 降到 0.79%;作者明确把学习到的克制定位为沙箱/门控之外的附加层。
浏览

评论 · Comments