每日 Harness 开源 · Source
返回本期 · Back to 2026-08-25

论文 · Papers2026-08-25 · Tuesday, August 25, 2026

ClawSentry: A Progressive Multi-Tier Security Monitor for Safeguarding Autonomous LLM Agents

arxiv.org原文 ↗

ClawSentry: A Progressive Multi-Tier Security Monitor for Safeguarding Autonomous LLM Agents
ClawSentry 把防护延伸到技能首次准入、调用意图、执行效果和事后后果,并以 L1 规则、L2 语义审查、只读 L3 agent 逐级消费审查预算;会话级逻辑还识别换工具和改写重试。在 SkillInject/Codex 上 ASR 从 39.55% 降到 2.61%,TSR 只从 83.78% 降到 83.05%,五个 Work Agent 的干净技能 TSR 为 98.7%。
–浏览

评论 · Comments