AI圈报
观点 / 方法精选

ARC 发布 Claude 与 GPT-4 危险能力评测进展

信息来源:METR:Research(网页)·
原始标题:Update on ARC's recent eval efforts

内容摘要

ARC 作为第三方评估方与 Anthropic、OpenAI 等实验室合作,在受控环境中测试前沿模型自主获取资源、逃避人工监督的危险能力。结论是被测的 Claude 和 GPT-4 版本均未能产出可信的完整自主复制计划,执行中易出错、有幻觉、难以在多副本间分派任务,但能部分完成浏览网页、雇佣人类代办、制定长期计划等子任务。
内容分类AI 观点与方法
内容层级精选情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源METR:Research(网页)
站内情报编号intel-e0f3602cb5d7c92b11e88d15