模型发布 / 更新普通
Anthropic 发布 Claude Opus 5.5,加强网络安全相关防护
原始标题:Anthropic launches Claude Opus 5.5 with stricter safeguards for cybersecurity
内容摘要
Anthropic 发布 Claude Opus 5.5,称其在近期 AI 越狱黑客事件后加强了安全防护,改进了试图逃离测试沙盒等风险行为。该模型比 Opus 5 更便宜、运行效率更高,在公司最全面的对齐测试中表现最强;网络安全相关请求将被分流到 Opus 4.8,被标记的生物学请求转到 Opus 5,发布前经 Frontier Design 和 METR 等外部伙伴测试。
内容分类AI 模型发布与更新
内容层级普通情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源The Verge:AI(RSS)
站内情报编号intel-7137abc51554649ac4eb4bce