XGenAct:几何增强世界动作模型
热点事件持续更新
XGenAct:几何增强世界动作模型
1 篇报道1 个报道来源5 小时前更新
先了解这件事
AI 综述
Tingting Du 等作者发布论文,提出世界动作模型 XGenAct。该模型通过确定性编解码器,把 RGB 观测、机器人动作、度量深度、表面法线和功能角色分割统一表示为 RGB 视频,再用单个视频扩散 Transformer 和一个目标函数跨这些空间学习时序预测,无需模态专用学习头。 论文将上述统一表示与跨空间时序预测作为核心方法,目前公开信息为 arXiv 上的论文本身。
AI 根据报道生成 · 2 小时前更新
最新进展10月5日 12:00
XGenAct:通过跨任务生成实现几何增强的世界动作模型报道时间线
沿着报道,了解事件的不同侧面。
10月5日
- arXiv:cs.LGXGenAct:通过跨任务生成实现几何增强的世界动作模型
XGenAct 是一种世界动作模型,通过确定性编解码器将 RGB 观测、机器人动作、度量深度、表面法线和功能角色分割统一表示为 RGB 视频,并用单个视频扩散 Transformer 和一个目标函数跨这些空间学习时序预测,无需模态专用学习头。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。