AI圈报
论文研究普通

RoboHarm 基准测试显示 GPT-6 Astra 与 Claude Fable 5.1 等模型很少拒绝危险机器人指令

信息来源:The Decoder:AI News(RSS)·
原始标题:GPT-6 Astra and Claude Fable turn robot arms into slapstick killer robots in new safety benchmark

内容摘要

Robocurve 团队发布 RoboHarm 安全基准,让 GPT-6 Astra、Claude Fable 5.1 和 MolmoAct2 分别控制一对 I2RT-YAM 机械臂,每条危险指令测试 20 次,共 300 次试验由人工审看视频评估。
内容分类AI 论文与研究
内容层级普通情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源The Decoder:AI News(RSS)
站内情报编号intel-eba0405a6e33a4091711b854