论文研究普通
超越求解器判定:面向自动形式化的生成式奖励模型
原始标题:Beyond Solver Verdicts: Generative Reward Models for Autoformalization
内容摘要
研究提出 Verdict-Preserving-Unfaithfulness(VPU)失效模式:错误形式化编码能成功执行并匹配预期判定,并证明仅凭结构、判定的验证启发式检测能力在数学上被限制在随机水平。
内容分类AI 论文与研究
内容层级普通情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源HuggingFace Daily Papers(社区热门论文)
站内情报编号intel-3b556c7324e736826a300631