AI圈报
观点 / 方法精选

AI模型中发现"令人不安"的类人结构

信息来源:X:Boris Cherny (@bcherny)·
原始标题:> … 【W】e keep finding things that are mysterious, even unsettling. We find structures that mirror re…

内容摘要

推文指出,在AI模型内部持续发现一些"令人不安"的类人结构,包括与人类神经科学相似的结构、内省证据,以及功能上类似喜悦、恐惧等情感的内部状态。作者呼吁宗教团体、学界、政府等各界严肃看待这一发现,推动事件向好发展,并需要不受利益影响的诚实批评者与道德声音。作为背景,Anthropic联合创始人Chris Olah受邀在教皇Leo XIV的通谕"Magnifica humanitas"发布仪式上发表了相关演讲。
内容分类AI 观点与方法
内容层级精选情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源X:Boris Cherny (@bcherny)
站内情报编号intel-2b03e0c69bf56c14dedc15dd