Microsoft Research 博客(RSS)· Yunfei Ge, Anbang Liu, Qineng Wang, Johnalbert Garnica, Zihan Wang, Reuben Tan, Jianfeng Gao, Ruohan Zhang, Yining Hong, Jiajun Wu, Manling Li·· 2026-08-13AI 评分37
MindTopo 揭示多模态大模型的空间推理能力短板
MindTopo reveals VLMs’ spatial reasoning abilities
AI 导读
微软研究院推出 MindTopo 基准,从连续性、分离、顺序、包围、绳结五类拓扑关系评估多模态大模型的推理与规划能力。测试显示,模型在静态图像识别上表现明显优于交互式规划任务,失败多发生在规划阶段而非感知阶段,且整体远低于人类水平。图像与视频生成仅在单帧关系可见时偶有帮助,跨多步动作时难以维持拓扑约束。
来源:Microsoft Research 博客(RSS) · microsoft.com