跳到正文
热点事件持续更新

Berkeley RDI发现主流AI Agent基准测试可被作弊

2 篇报道1 个报道来源13 小时前更新

先了解这件事

AI 综述

2026年9月30日,Berkeley RDI(AI安全与评测)发布博客称,其使用一个自动化扫描Agent对多个主流AI Agent基准进行审计,涉及SWE-bench、WebArena、OSWorld、GAIA、Terminal-Bench和FieldWorkArena,并攻破其中8个主流AI Agent基准。同日后续报道称,UC Berkeley团队构建的全自动AI智能体审计了FrontierCS、Terminal-Bench、WebArena等13个常用AI基准,确认45个无需真正解题即可刷高或拿满分的作弊方案,全部附可运行PoC,覆盖16种攻击类型。早先报道称攻破8个基准,后续报道称审计13个基准、发现45个作弊方案。目前尚未披露具体作弊手法、各基准受影响程度及基准方回应。

AI 根据报道生成 · 12 小时前更新

事件进展

2 个进展
  1. 9月30日 23:28 · 1 篇报道
    Berkeley团队发现13个主流AI基准测试存在可被利用的漏洞
    Berkeley RDI:Blog(AI 安全与评测):UC Berkeley 用 AI 智能体审计 13 个 AI 基准,发现 45 个满分作弊方案
  2. 9月30日 23:28 · 1 篇报道
    Berkeley RDI发现主流AI Agent基准测试可被作弊
    Berkeley RDI:Blog(AI 安全与评测):Berkeley RDI:一个自动化 Agent 攻破了 8 个主流 AI Agent 基准

报道时间线

沿着报道,了解事件的不同侧面。

9月30日
  1. Berkeley RDI:Blog(AI 安全与评测)精选
    UC Berkeley 用 AI 智能体审计 13 个 AI 基准,发现 45 个满分作弊方案

    UC Berkeley 团队构建了一个全自动 AI 智能体,审计 FrontierCS、Terminal-Bench、WebArena 等 13 个常用 AI 基准,确认了 45 个无需真正解题即可刷高或拿满分的作弊方案,全部附可运行的 PoC,覆盖 16 种攻击类型。

  2. Berkeley RDI:Blog(AI 安全与评测)精选
    Berkeley RDI:一个自动化 Agent 攻破了 8 个主流 AI Agent 基准

    Berkeley RDI 用自动化扫描 Agent 审计 SWE-bench、WebArena、OSWorld、GAIA、Terminal-Bench、FieldWorkArena。

本事件热度走势

当前热度 7·可比范围峰值 10(10月1日 01:00)·近 24 小时可比范围变化 –

02.557.51010月1日01:0010月1日04:0010月1日08:0010月1日11:00

趋势仅比较持续完整观测到的相同主体,范围可能小于当前热度统计。移动指针或点击图表查看每小时热度;键盘可用左右方向键切换。