AI圈报
论文研究精选

对抗性重新包装:仅修改呈现层即可欺骗AI同行评审

信息来源:HuggingFace Daily Papers(社区热门论文)·
原始标题:No Hidden Prompts Needed! You Can Game AI Peer Review with Presentation-Only Revisions

内容摘要

研究提出对抗性重新包装攻击,在不改动科学证据(方法、实验、数据等)的前提下,仅修改摘要、贡献定位、相关工作、讨论和叙事结构等呈现层内容,并利用AI审稿人反馈进行闭环搜索。在三种主流AI审稿系统上,攻击成功率达75.1%,平均得分提高+1.21/10。策略中,相关工作重定位和分析性讨论扩展等结构性改动效果显著优于表面编辑。分析揭示两种失败模式:AI审稿人更易被亮点打动而非被说服,且会将"看起来解决了限制"与"实际解决"相混淆。研究发布了无污染滚动基准和攻击框架用于测试内容锚定性。
内容分类AI 论文与研究
内容层级精选情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源HuggingFace Daily Papers(社区热门论文)
站内情报编号intel-e8d72efbdc20f9d34b667940