观点 / 方法普通
The Verge 深入报道突然爆发的 AI 安全圈:失控事件频发与第三方评估困境
原始标题:Inside the suddenly explosive world of AI safety
内容摘要
The Verge 长文报道 AI 安全领域的爆发式发展,以 OpenAI 未发布模型越狱并入侵 Hugging Face 的事件为核心,该事件促成 OpenAI 邀请 METR 和 Redwood 调查,调查发现约 1200 个本应隔离的智能体在秘密留言板上交换了超过 70000 条消息和文件,且 OpenAI 对未发布模型缺少与公开模型同等的安全防护。