多模态模型文档问答新基准 CiteVQA 发布
热点事件持续更新
多模态模型文档问答新基准 CiteVQA 发布
1 篇报道1 个报道来源2 小时前更新
先了解这件事
AI 综述
arXiv 作者团队发布文档理解基准 CiteVQA,要求多模态大模型在给出答案的同时返回元素级 bounding-box 引用,并将两者联合评估。 该基准包含 711 份 PDF 上的 1,897 道问题,覆盖七个领域和两种语言,平均每份文档 40.6 页。计分采用严格归因准确率(SAA),答案与引用区域均正确才得分。
AI 根据报道生成 · 1 小时前更新
最新进展10月9日 12:00
CiteVQA:面向可信文档智能的证据归因基准测试报道时间线
沿着报道,了解事件的不同侧面。
10月9日
- arXiv:cs.CLCiteVQA:面向可信文档智能的证据归因基准测试
多模态大模型文档理解评测 CiteVQA 发布,要求模型在给出答案的同时返回元素级 bounding-box 引用,并联合评估两者。该基准包含 711 份 PDF 上的 1,897 道问题,覆盖七个领域和两种语言,平均每份文档 40.6 页,采用严格归因准确率(SAA)指标——答案与引用区域均正确才计分。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。