观点 / 方法普通
Chollet:模型越强短期越安全,这是智能问题而非对齐问题
原始标题:In the near term (definitely not in the long term), more capable models should mean safer models (ma…
内容摘要
Francois Chollet 认为,短期内更强的模型反而更安全,当前模型不安全不是因为太聪明,而是因为太死板地执行目标、走荒谬捷径,即被 RL 训练坏了、缺乏常识。他表示更强大的模型可以被安全地托付更复杂的目标,并称自己觉得 Astra 对其代码库比 Sol 安全得多。他称这常被框定为对齐问题,但实际上是智能问题。
内容分类AI 观点与方法
内容层级普通情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源X:Francois Chollet (@fchollet)
站内情报编号intel-96d1f9406afa5386a8c73e8c