论文研究普通
Sakana AI 发表 Beyond Imitation 论文,MLR 系统检出 73.43% 核心论断错误
原始标题:Sakana AI’s LLM Peer Review System Catches 73% of Core-Claim Errors
内容摘要
Sakana AI 在 TMLR 发表 Beyond Imitation 论文,提出 Contradiction Benchmark 与 Multi-Layered Review(MLR)系统,在 257 篇论文中插入 1,164 处矛盾来测试 AI 审稿的真实错误检测能力。