跳到正文
原文
arXiv:cs.CL(计算语言学,全量分类)· Xia Hu, Brian Potetz, Chun-Ta Lu, Huanfen Yao, Leonidas Guibas, Zhicheng Wang, Howard Zhou, Pengfei Xing, Andrew Gallagher·· 3 小时前AI 评分46

多模态大模型在哪里失败、为何失败:用于能力失败诊断的因果任务分解框架

Where MLLMs Fail and Why: Causal Task Decomposition for Capability Failure Diagnosis

AI 导读

研究者提出因果分解框架,通过控制任务前置依赖,将 MLLM 的失败区分为目标能力的固有缺陷与上游级联错误,并给出 NC、IC、RC 能力指标与 N-Score、S-Score 贡献指标。

来源:arXiv:cs.CL(计算语言学,全量分类) · arxiv.org