十英雄MOBA世界模型Dyna循环研究发布
热点事件持续更新
十英雄MOBA世界模型Dyna循环研究发布
1 篇报道1 个报道来源5 小时前更新
先了解这件事
AI 综述
Jordy Kieto 发布十英雄 MOBA 世界模型研究并开源模型、训练框架与评测协议,采用连续异步 Dyna 循环,使仅靠想象训练的策略真实对局胜率达 70.2%。 该结果针对 206 单位、单局最多 6000 tick 的完整十英雄 MOBA,策略在想象中训练,真实游戏不提供梯度;据论文,作为天辉方在未参与任何决策的种子上 600 局胜 421 局(95% CI 66.4–73.7),高于单纯梦境训练的 0% 和循环前的 33.7%。 论文同时称,策略作为夜魇方未赢过,自带对手自我对弈时也未赢过。
AI 根据报道生成 · 2 小时前更新
最新进展10月7日 12:00
十英雄 MOBA 世界模型研究:连续 Dyna 循环让想象训练的策略真实胜率达 70.2%报道时间线
沿着报道,了解事件的不同侧面。
10月7日
- arXiv:cs.AI十英雄 MOBA 世界模型研究:连续 Dyna 循环让想象训练的策略真实胜率达 70.2%
作者为完整十英雄 MOBA(206 单位、单局最多 6000 tick)训练结构化多智能体世界模型,仅在想象中训练策略,再以连续异步 Dyna 循环在真实对局中评估,真实游戏不提供梯度。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。