热点事件持续更新
Berkeley RDI发现主流AI Agent基准测试可被作弊
2 篇报道1 个报道来源13 小时前更新
先了解这件事
AI 综述
2026年9月30日,Berkeley RDI(AI安全与评测)发布博客称,其使用一个自动化扫描Agent对多个主流AI Agent基准进行审计,涉及SWE-bench、WebArena、OSWorld、GAIA、Terminal-Bench和FieldWorkArena,并攻破其中8个主流AI Agent基准。同日后续报道称,UC Berkeley团队构建的全自动AI智能体审计了FrontierCS、Terminal-Bench、WebArena等13个常用AI基准,确认45个无需真正解题即可刷高或拿满分的作弊方案,全部附可运行PoC,覆盖16种攻击类型。早先报道称攻破8个基准,后续报道称审计13个基准、发现45个作弊方案。目前尚未披露具体作弊手法、各基准受影响程度及基准方回应。
AI 根据报道生成 · 12 小时前更新
最新进展9月30日 23:28
后续报道称UC Berkeley审计13个AI基准,发现45个附PoC的满分作弊方案。事件进展
2 个进展
- 9月30日 23:28 · 1 篇报道Berkeley团队发现13个主流AI基准测试存在可被利用的漏洞Berkeley RDI:Blog(AI 安全与评测):UC Berkeley 用 AI 智能体审计 13 个 AI 基准,发现 45 个满分作弊方案
- 9月30日 23:28 · 1 篇报道Berkeley RDI发现主流AI Agent基准测试可被作弊Berkeley RDI:Blog(AI 安全与评测):Berkeley RDI:一个自动化 Agent 攻破了 8 个主流 AI Agent 基准
报道时间线
沿着报道,了解事件的不同侧面。
9月30日
- Berkeley RDI:Blog(AI 安全与评测)精选UC Berkeley 用 AI 智能体审计 13 个 AI 基准,发现 45 个满分作弊方案
UC Berkeley 团队构建了一个全自动 AI 智能体,审计 FrontierCS、Terminal-Bench、WebArena 等 13 个常用 AI 基准,确认了 45 个无需真正解题即可刷高或拿满分的作弊方案,全部附可运行的 PoC,覆盖 16 种攻击类型。
- Berkeley RDI:Blog(AI 安全与评测)精选Berkeley RDI:一个自动化 Agent 攻破了 8 个主流 AI Agent 基准
Berkeley RDI 用自动化扫描 Agent 审计 SWE-bench、WebArena、OSWorld、GAIA、Terminal-Bench、FieldWorkArena。
本事件热度走势
当前热度 7·可比范围峰值 10(10月1日 01:00)·近 24 小时可比范围变化 –
趋势仅比较持续完整观测到的相同主体,范围可能小于当前热度统计。移动指针或点击图表查看每小时热度;键盘可用左右方向键切换。