跳到正文
热点事件持续更新

论文:AI攻击能力评测被指高估危害

1 篇报道1 个报道来源5 小时前更新

先了解这件事

AI 综述

Michael Alexander Riegler等作者发表论文,指出目前衡量AI攻击能力的工具存在两类失效:高估危害,以及把属于周边系统的能力记在模型头上。作者称,越狱评测会高估实际危害,AI的攻击能力应归因于模型、脚手架与评测协议构成的整体,而非单个模型。 基于此,论文主张政策与采购环节采用系统级、以危害为基准的能力评估。该结论系作者在论文中提出,尚待验证。

AI 根据报道生成 · 2 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月8日
  1. arXiv:cs.LG
    arXiv 论文:越狱评测高估危害,AI 攻击能力应归因于模型、脚手架与评测协议整体

    arXiv 论文指出衡量 AI 攻击能力的现有工具存在两类失效:高估危害、把属于系统的能力记在模型头上,主张政策与采购需要系统级、以危害为基准的能力评估。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。