位置泛化(空间泛化)
Position / Spatial Generalization常用物体摆到训练时没出现过的位置或朝向,策略仍能做对的能力。
位置泛化指任务和物体都不变,只是物体或机器人自身的初始位置、朝向换到训练数据没覆盖的地方,策略还能不能成功。OpenVLA 的评测把它叫「运动泛化」,定义就是没见过的物体位置和朝向。它是视觉运动策略的常见短板:模仿学习得到的策略往往只在演示覆盖过的区域附近可靠,物体挪远一点成功率就明显下降,所以采数据时要在桌面不同位置反复摆放。DemoGen 为此用一条真人演示合成出大量不同位置的演示;LIBERO-Plus 发现,只要稍微扰动机器人初始状态或相机视角,一些 VLA 的成功率就会从 95% 跌到 30% 以下。
例子训练时方块只放在桌面左半边,测试时放到右半边或旋转 90 度,看机械臂能否照样抓起。
- 也叫
- 空间泛化、位置泛化、运动泛化、Motion Generalization
- 相关
- 泛化、物体泛化、场景泛化、分布外、DemoGen、LIBERO-Plus
- 来源
- OpenVLA: An Open-Source Vision-Language-Action Model
DemoGen: Synthetic Demonstration Generation for Data-Efficient Visuomotor Policy Learning
LIBERO-Plus: In-depth Robustness Analysis of Vision-Language-Action Models - 信息截至
- 2025-10