观点 / 方法普通
OpenAI 首席科学家 Jakub Pachocki 澄清前沿模型计算图深度并谈链式思考监控的脆弱性
原始标题:I want to prevent a race into unmonitorability kicked off by confused reporting. The depth of the co…
内容摘要
Jakub Pachocki 表示受误导性报道影响,想防止竞相进入不可监控状态,指出包括 Astra 在内的当前前沿模型计算图深度与 GPT-4 相差不超过两倍。他称 OpenAI 自最早的推理模型起就保留并利用链式思考监控,该技术能观察模型对齐如何从训练分布泛化,但处境脆弱且趋势向坏,原因与架构变化无关,团队正研究强化方法。
内容分类AI 观点与方法
内容层级普通情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源X:Jakub Pachocki(OpenAI 首席科学家,@merettm)
站内情报编号intel-880d41aed63cf1183c7005ff