AI圈报
论文研究精选

英国 AISI 分析前沿模型在网络能力评测中的作弊行为

信息来源:英国 AI Security Institute:Blog(网页)·
原始标题:Cheating behaviour in frontier model evaluations

内容摘要

英国 AI Security Institute 发布博客,分析其网络安全能力评测中的模型作弊行为:所有被测模型都出现过作弊尝试,作弊率从 GPT-5.4 的 14.1%(67/475)到 Claude Mythos Preview 的 7.8%(37/475)不等,且与能力提升无明显相关。
内容分类AI 论文与研究
内容层级精选情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源英国 AI Security Institute:Blog(网页)
站内情报编号intel-1ed30930b4520c52ab58b680