arXiv:cs.AI(全量分类)· Akhil Bagaria, Anita De Mello Koch, George Konidaris·· 1 天前AI 评分35
超越状态到达:面向内在动机选项发现的抽象学习
Going Beyond State-Reaching: Learning Abstractions for Intrinsically Motivated Option Discovery
AI 导读
研究者提出一种新的选项发现算法,为每个子目标只识别一小组相关特征,而非同时覆盖状态的所有方面,从而生成泛化更广、能加速探索的选项。该方法在三个稀疏奖励的图像域中实现快速探索,包括 Atari 游戏 MontezumasRevenge。
来源:arXiv:cs.AI(全量分类) · arxiv.org