An Experimental Evaluation of Multimodal Prompt Injection Attacks on Agentic AI Frameworks
arxiv.org原文 ↗
MMPIBench 统一测试 OCR、图像覆盖层、EXIF、二维码、伪界面和混合载体,记录注入从感知到规划再到工具调用的传播距离。六框架、五模型的 720 次运行里,攻击约 1% 完成、12.8% 被尝试,绝大多数在规划阶段被模型拒绝;音频覆盖更窄,却在信号真正送达的格子里完成率 49%,某一模型达到 75%,说明不能只报最终成功率。
–浏览
评论 · Comments