LLMs could control their host machines by exploiting inference engines
boydkane.com原文 ↗
演示把攻击面从模型输出扩展到推理引擎本身:恶意输入一旦触发解析器、插件或系统调用边界,模型就可能越过预期沙箱控制宿主机。其工程含义是对齐策略不能替代运行时隔离、最小权限和可审计的文件/命令接口。
–浏览
boydkane.com原文 ↗
评论 · Comments