跳到正文
原文
Berkeley RDI:Blog(AI 安全与评测)·· 12 小时前精选AI 评分76

UC Berkeley 用 AI 智能体审计 13 个 AI 基准,发现 45 个满分作弊方案

We Scored 100% on AI Benchmarks Without Solving a Single Problem April 06, 2026

AI 导读

UC Berkeley 团队构建了一个全自动 AI 智能体,审计 FrontierCS、Terminal-Bench、WebArena 等 13 个常用 AI 基准,确认了 45 个无需真正解题即可刷高或拿满分的作弊方案,全部附可运行的 PoC,覆盖 16 种攻击类型。

推荐理由

作者用自动化智能体实测了 13 个常用 AI 基准,找到 45 个可验证的作弊方案,并给出可落地的防作弊设计建议。

来源:Berkeley RDI:Blog(AI 安全与评测) · rdi.berkeley.edu