跳到正文
热点事件持续更新

研究者提出SSU-Bench并因果追踪VLM安全判断

1 篇报道1 个报道来源5 小时前更新

先了解这件事

AI 综述

Faezeh Dehghan Tarzjani 等作者提交论文《From Local Evidence to Safety Verdicts: Causal Tracing in Vision-Language Models》,并提出 SSU-Bench 数据集。该数据集由成对的安全与不安全图文组合构成,这些组合通过单项提示词编辑或带标注目标区域的图像编辑生成。 研究者用该数据集在三个视觉语言模型上交换配对输入的内部状态,以测量模型安全判定的变化。

AI 根据报道生成 · 3 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月7日
  1. arXiv:cs.AI
    从局部证据到安全判定:视觉语言模型中的因果追踪

    研究者提出 SSU-Bench 数据集,用单项提示词编辑或图像编辑构建成对的安全与不安全图文组合,并在三个视觉语言模型上交换配对输入的内部状态以测量安全判定变化。

本事件热度走势

可比范围当前
9
可比范围峰值
910月7日 14:00
近 24 小时变化
–

趋势仅比较持续完整观测到的相同主体,范围可能小于当前热度统计。移动指针或点击图表查看每小时热度;键盘可用左右方向键切换。