论文研究普通
MALA:让注意力自行分配其计算量的融合注意力原语
原始标题:MassAlloc Attention: Let Attention Allocate Its Own Compute
内容摘要
研究者提出融合注意力原语 MALA,按归一化贡献分配 post-score 计算,在 8K 匹配工作量下平均遗漏质量仅 0.0188%,接近逐实例参考质量 oracle 的 0.0182%。
内容分类AI 论文与研究
内容层级普通情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源HuggingFace Daily Papers(社区热门论文)
站内情报编号intel-c0acb080bd1e7001443fd10e