The Malicious Use of Artificial Intelligence
arxiv.org原文 ↗
报告把 AI 恶意使用划分为数字、物理和政治三类,讨论规模化自动攻击如何改变既有安全假设,并给出四项高层防御建议。它不是某个单点漏洞论文,而是把攻击者与防守者的长期适应关系作为未解决问题保留下来;2018 年初稿在 2024 年仍有修订,显示议题并未随模型代际更替而失效。
–浏览
arxiv.org原文 ↗
评论 · Comments