论文研究普通
盲人摸象:探测大语言模型在长尾分歧知识下的认知盲区
原始标题:Blind Men and the Elephant: Probing the Epistemic Myopia of LLMs under Long-Tail Divergent Knowledge
内容摘要
ElephantBench 闭卷知识探针含 1,094 道基于可审计图流程生成的多方叙述问答。测试 32 个模型,最强模型也仅在 52.4% 的问题上同时召回两种叙述,其余大多只记得一种。扩大模型规模和推理时计算能提升召回率但无法消除不完整性,代码已开源。
内容分类AI 论文与研究
内容层级普通情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源HuggingFace Daily Papers(社区热门论文)
站内情报编号intel-dea29f1a40152b3663ebba57