AI圈报
论文研究精选

UC Berkeley 团队用 AI Agent 审计 13 个基准,发现 45 个无需解题的满分作弊方案

信息来源:Berkeley RDI:Blog(AI 安全与评测)·
原始标题:We Scored 100% on AI Benchmarks Without Solving a Single Problem April 06, 2026

内容摘要

UC Berkeley 团队构建全自动 AI Agent 审计 13 个广泛使用的基准,发现 45 个作弊方案,全部基准被评为 critical 风险,共归纳 16 种攻击类型。
内容分类AI 论文与研究
内容层级精选情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源Berkeley RDI:Blog(AI 安全与评测)
站内情报编号intel-75d797ec56ea7413b37fa90c