每日 Harness 开源 · Source
返回本期 · Back to 2026-08-29

论文 · Papers2026-08-29 · Saturday, August 29, 2026

When Tool Outputs Become Commands: Separating Action Induction from Runtime Authorization in Tool-Augmented LLM Agents

arxiv.org原文 ↗

When Tool Outputs Become Commands: Separating Action Induction from Runtime Authorization in Tool-Augmented LLM Agents
SARA 在观察侧以隔离 Action Probe 持久记录诱导语义和来源,在执行侧只接受由用户目标与已授权成功调用支撑的工具请求。No-History-Promotion 阻止旧观察把不可信指令升级成权限,AgentDojo 和 AgentDyn 四个主设置的 ASR 不超过 0.63%,说明来源链与授权链分离能直接降低副作用风险。
–浏览

评论 · Comments