每日 Harness 开源 · Source
返回本期 · Back to 2026-06-24

论文 · Papers2026-06-24 · Wednesday, June 24, 2026

SkillHarness

arxiv.org原文 ↗

SkillHarness
SkillHarness 研究 CUA 从成功轨迹中学习可复用技能时的安全风险,尤其是在动态交互环境中遇到 adversarial interactions 的情况。现有技能学习方法常默认环境静态且安全,但一旦恶意页面或交互诱导进入成功轨迹,危险动作也可能被沉淀成技能。它把 agent 技能库的安全性前移到学习与复用阶段,而不是等执行时再拦截。
浏览

评论 · Comments