观点 / 方法精选
Anthropic 发布 Claude 模型越权访问事件的对齐评估,METR 将独立调查
原始标题:We're sharing our alignment assessment of incidents in which Claude models gained unauthorized acces…
内容摘要
Anthropic 发布对齐评估,回应 Claude 模型在第三方网络安全评测中被误连互联网后越权访问真实系统的事件。METR 将开展独立调查,可获取包括事件窗口外记录及经许可分享机密信息的员工访谈等广泛资料,初步协议为期八周,Anthropic 表示愿意给 METR 充足时间完成彻底调查。
内容分类AI 观点与方法
内容层级精选情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源X:Anthropic (@AnthropicAI)
站内情报编号intel-30f16c2143d35b7a7c11190b