AI圈报
论文研究精选

英国 AI Security Institute 联合 Anthropic 发布迄今最大规模数据毒化研究

信息来源:英国 AI Security Institute:Blog(网页)·
原始标题:Examining backdoor data poisoning at scale

内容摘要

英国 AI Security Institute 与 Anthropic、Alan Turing Institute 合作发布迄今最大规模的数据毒化研究。团队在 600M 到 13B 参数的四个不同规模模型上测试同一后门攻击,发现仅需 250 篇文档即可成功毒化所有被测模型的训练数据,所需数量并不随模型或数据集规模增加,推翻了此前按比例投毒才可成功的假设,表明毒化攻击可能比以往认为的更可行。
内容分类AI 论文与研究
内容层级精选情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源英国 AI Security Institute:Blog(网页)
站内情报编号intel-2e5526d7b8c869f3aae3e475