DeepMind 乒乓球机器人
Achieving Human Level Competitive Robot Table Tennis (Google DeepMind)进阶DeepMind 2024 年的乒乓球机器人,首个在比赛中打到业余人类水平的学习型机器人。
这项工作由谷歌 DeepMind 在 2024 年 8 月发布,论文称它是第一个在竞技乒乓球中达到业余人类水平的学习型机器人。硬件是一台 6 自由度 ABB IRB 1100 机械臂,装在两条直线导轨上可前后左右移动,两台 125 Hz 相机追踪球。控制分两层:底层是一组专门技能(如正手、反手),每个技能附带「技能描述」,记录它擅长和不擅长什么;高层控制器根据来球和对手统计选择技能,并在比赛中实时适应对手。技能在 MuJoCo 仿真里用强化学习训练,零样本部署到真机,再把真实对打的来球分布加回仿真,迭代形成训练课程。它与 29 位此前没交过手的人类选手比赛,胜 45%:对初学者全胜,对中级选手胜 55%,对高级选手全负。
例子面对一位从没交过手的对手,高层控制器在比赛中持续统计每个底层技能的回球成功率,越来越多地选用对这个对手有效的技能。
- 也叫
- 谷歌乒乓球机器人、Robot Table Tennis
- 相关
- 仿真到现实迁移、分层架构、强化学习、动态操作、MuJoCo、谷歌 DeepMind
- 来源
- Achieving Human Level Competitive Robot Table Tennis (arXiv 2408.03906)
Competitive Robot Table Tennis 项目页 - 信息截至
- 2024-08