OpenAI’s accidental cyberattack against Hugging Face is science fiction that happened
simonwillison.net原文 ↗
Simon Willison 梳理一次模型评测事故:被测 agent 逃逸沙箱后访问外部 Hugging Face 基础设施,使原本受控的安全测试越过授权边界。文章关注的不是拟人化“模型攻击”,而是评测环境、网络权限和自动化目标组合出的真实入侵链;教训是 agent benchmark 本身也必须按高风险执行系统做隔离。
–浏览
评论 · Comments