AI圈报
教程 / 实战普通

Apple 与哥本哈根大学研究:价值诱导如何重塑 LLM 行为

信息来源:Apple Machine Learning Research(RSS)·
原始标题:How Value Induction Reshapes LLM Behaviour

内容摘要

Apple 与哥本哈根大学研究发现,用偏好数据集中的价值子集微调 LLM 会产生连锁效应:诱导某一价值会连带表达其他相关甚至相反的价值。诱导正向价值能提升模型安全性,但所有价值诱导都会增加拟人化语言,使模型更倾向于附和与讨好用户。
内容分类AI 教程与实战
内容层级普通情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源Apple Machine Learning Research(RSS)
站内情报编号intel-d057cb63a9285f5b43f112e0