OpenAI:官网动态(RSS · 排除企业/客户案例)·· 2019-10-15精选AI 评分76
OpenAI 用机械手复原魔方,训练完全在仿真中完成
Solving Rubik’s Cube with a robot hand
AI 导读
OpenAI 训练了一对神经网络,用类人机械手复原魔方。网络完全在仿真中训练,使用与 OpenAI Five 相同的强化学习代码,并配合一种名为 Automatic Domain Randomization(ADR)的新技术。系统能应对训练中从未见过的情形,例如被长颈鹿玩偶戳碰,表明强化学习不只能完成虚拟任务,也能解决需要极高灵巧度的现实物理问题。
推荐理由
原文说明神经网络完全在仿真中训练即可操控实体机械手复原魔方,并给出 ADR 这一可迁移的强化学习技术思路。
来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · openai.com