论文研究普通
300M 参数 PFLM:不学任何语言,只学“如何学语言”
原始标题:Learning to Learn a Language
内容摘要
研究者提出 Prior-Fitted Language Model(PFLM),一个 300M 参数的字节级 transformer,仅用合成非语言先验样本预训练,冻结权重下靠前缀在上下文中推断语言。
内容分类AI 论文与研究
内容层级普通情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源HuggingFace Daily Papers(社区热门论文)
站内情报编号intel-2a68a38fe392d641d1f537a1