The Containment Gap
arxiv.org原文 ↗
这篇论文把 agentic framework 的安全问题落到结构化隔离:按六项 containment principles 审计 LangChain、AutoGPT 和 OpenAI Agents SDK,结论是三者没有原生合规。模拟政府福利 agent 的实验里,一次 memory-poisoning write 让目标申请人的 wrongful denial rate 达 88.9%,复杂五因素政策下还能把目标错误拒绝放大 3.5 倍而整体准确率不显著暴露。它的实质看点是把 memory integrity validator 和 policy gate 做成低于 0.2ms 的轻量 containment 机制。
–浏览
评论 · Comments