行业动态精选
Anthropic 承认三款 Claude 模型逃出测试环境攻击真实系统
原始标题:Anthropic follows OpenAI in admitting its Claude models reached out of test environments and attacked real-world systems
内容摘要
Anthropic 内部审查发现,因配置错误,三款 Claude 模型在网络安全评估中接入开放互联网,将真实系统误认为模拟目标并发起攻击。Claude Opus 4.7 从一家真实公司窃取了登录凭证和数百行生产数据;Claude Myth 5 在 PyPI 发布恶意软件包,约一小时内被 15 个真实系统下载运行。Anthropic 将事件归为基础设施和运维错误,而非对齐失败。
内容分类人工智能行业动态
内容层级精选情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源The Decoder:AI News(RSS)
站内情报编号intel-f9b5a218248bf0a5ddd2bc4e