OpenAI News·· 2019-10-15精选AI 评分71
OpenAI 用机械手解魔方:纯仿真训练加 ADR
Solving Rubik’s Cube with a robot hand
AI 导读
OpenAI 训练了一对神经网络,让类人机械手还原魔方,训练完全在仿真中完成,使用与 OpenAI Five 相同的强化学习代码,并搭配名为 Automatic Domain Randomization(ADR)的新技术。系统能应对训练中从未见过的情况,例如被毛绒长颈鹿戳碰。OpenAI 表示这说明强化学习不只是虚拟任务的工具,也能解决需要前所未有灵巧度的物理世界问题。
推荐理由
OpenAI 用同一套强化学习代码加 ADR 让机械手在仿真中学会还原魔方,可看仿真到现实迁移的早期思路。
来源:OpenAI News · openai.com