No Hidden Prompts Needed! You Can Game AI Peer Review with Presentation-Only Revisions
arxiv.org原文 ↗
这项研究不使用隐藏指令,也不改方法、实验、图表、证明或数值,只优化 abstract、贡献框架、相关工作、讨论等呈现层内容。闭环 adversarial repackaging 在三个主流 AI reviewer 上达到 75.1% attack success rate,平均分增加 +1.21/10,且强于普通润色。关键警示是 AI reviewer 会把“看起来回应了限制”误读成“实际解决了限制”,所以 peer review 自动化的风险面已经扩展到论文叙事本身。
–浏览
评论 · Comments