ChannelGuard: Safe Models Do Not Compose into Safe Multi-Agent Systems
arxiv.org原文 ↗
ChannelGuard 研究恶意指令如何借助 Agent 间消息、共享记忆和工具返回值传播,指出单个模型都通过安全评测并不保证组合后的系统安全。防护器因此部署在内部通信通道上,对消息来源、传播路径和下游权限进行检查。论文把安全边界从用户入口移到整个消息拓扑,揭示多 Agent 编排中的信任关系本身就是攻击面。
–浏览
评论 · Comments