跳到正文
热点事件持续更新

XGenAct:几何增强世界动作模型

1 篇报道1 个报道来源5 小时前更新

先了解这件事

AI 综述

Tingting Du 等作者发布论文,提出世界动作模型 XGenAct。该模型通过确定性编解码器,把 RGB 观测、机器人动作、度量深度、表面法线和功能角色分割统一表示为 RGB 视频,再用单个视频扩散 Transformer 和一个目标函数跨这些空间学习时序预测,无需模态专用学习头。 论文将上述统一表示与跨空间时序预测作为核心方法,目前公开信息为 arXiv 上的论文本身。

AI 根据报道生成 · 2 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月5日
  1. arXiv:cs.LG
    XGenAct:通过跨任务生成实现几何增强的世界动作模型

    XGenAct 是一种世界动作模型,通过确定性编解码器将 RGB 观测、机器人动作、度量深度、表面法线和功能角色分割统一表示为 RGB 视频,并用单个视频扩散 Transformer 和一个目标函数跨这些空间学习时序预测,无需模态专用学习头。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。