跳到正文
热点事件持续更新

多模态模型视觉弃权基准DoD与VisTA方法提出

1 篇报道1 个报道来源5 小时前更新

先了解这件事

AI 综述

Chufan Shi 等作者发布论文,提出「视觉弃权」任务:当视觉变换请求不可行时,统一多模态模型应识别并拒绝生成,而非强行输出。 作者同时提出 DoD(Draw-or-Decline)基准,包含 7 类任务、1,050 组可行与不可行请求对,同时衡量编辑成功率与对不可行请求的拒绝;并给出 VisTA 训练方法。论文尚未给出该方法在其他模型上的验证结果。

AI 根据报道生成 · 2 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月7日
  1. arXiv:cs.AI
    统一多模态模型视觉拒绝研究:提出 Draw-or-Decline 基准与 VisTA 训练方法

    arXiv 论文提出视觉拒绝(visual abstention)概念:当视觉变换请求不可行时,模型应识别并拒绝生成。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。