热点事件持续更新
VLM社交导航理解基准SocialNav-SUB发布
1 篇报道1 个报道来源5 小时前更新
先了解这件事
AI 综述
2026年10月3日,arXiv cs.LG分类发布论文《STARS:从时空动态到人机交互中的社会表征》。研究者提出SocialNav-SUB,一个用于评估视觉语言模型(VLM)在真实社交机器人导航场景中场景理解能力的VQA数据集与基准,覆盖空间、时空与社会推理任务。实验显示,表现最好的VLM虽能与人类答案有较高一致概率,但仍不及更简单的规则方法和人类共识基线,表明当前VLM在社交场景理解上存在关键缺口。该基准为社交机器人导航基础模型研究提供统一评估框架,论文入选CoRL 2026。
AI 根据报道生成 · 2 小时前更新
最新进展10月3日 12:00
SocialNav-SUB基准发布,显示VLM社交场景理解仍不及规则方法与人类基线。报道时间线
沿着报道,了解事件的不同侧面。
10月3日
- arXiv:cs.LG(机器学习,全量分类)STARS:从时空动态到人机交互中的社会表征
研究者提出 SocialNav-SUB,一个用于评估 VLM 在真实社交机器人导航场景中场景理解能力的 VQA 数据集与基准,覆盖空间、时空与社会推理任务。实验显示表现最好的 VLM 虽能与人类答案有较高一致概率,但仍不及更简单的规则方法和人类共识基线,表明当前 VLM 在社交场景理解上存在关键缺口。该基准为社交机器人导航基础模型研究提供统一评估框架,论文入选 CoRL 2026。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。