AI圈报
论文研究精选

Arena 研究:LLM 裁判偏爱自己答案的概率比人类高 70%

信息来源:X:Arena (@arena)·
原始标题:LLM judges prefer their own responses 70% more often than humans do

内容摘要

Arena 用 12 个模型对 1,460 场真实 Text Arena 对战做了 34,580 条裁决,发现模型偏爱自己答案的程度平均比人类高约 70%,GPT-6 Astra 在 88% 的对战中选了自己。OpenAI 三款裁判对 OpenAI 模型比人类宽容 37 分,AI 裁判之间一致率 79.4%,但与人类投票者只有 56.9%;模型很少判平局,Sol 在 96% 的对战中强行选出赢家。
内容分类AI 论文与研究
内容层级精选情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源X:Arena (@arena)
站内情报编号intel-3c96b92d46ada7b20754efc2