RLDS 格式
RLDS (Reinforcement Learning Datasets)RLDS常用谷歌提出的按「回合—步」两层组织序列决策数据的标准格式与工具链。
RLDS 是 Google Research 在 2021 年发布的数据生态,用来记录、共享和处理强化学习、离线强化学习和模仿学习数据。数据分两层:episode(回合)带 episode_id 等元数据,里面是一串 step(步);每步必有 is_first、is_last 两个标志,可选 observation、action、reward、discount 等字段。配套 EnvLogger 记录数据,经 TensorFlow Datasets(TFDS)发布和读取。它让不同实验室的数据能用同一套代码读:Open X-Embodiment 的各个子数据集都按 RLDS 回合格式提供,Octo、OpenVLA 的训练代码直接读它。PyTorch 生态近年更多转向 LeRobotDataset,RLDS 的 GitHub 仓库已于 2025 年 11 月归档。
例子用 tfds.load 读取 Open X-Embodiment 里的 BridgeData V2 子集,逐个回合遍历其中的 steps,取出每一步的图像、语言指令和动作送进训练。
- 也叫
- RLDS 数据格式
- 相关
- Open X-Embodiment 数据集、TFDS(TensorFlow Datasets)、TFRecord 格式、LeRobot 数据集格式、HDF5 格式、回合
- 来源
- RLDS: an Ecosystem to Generate, Share and Use Datasets in Reinforcement Learning
google-research/rlds (GitHub)
google-deepmind/open_x_embodiment (GitHub) - 信息截至
- 2025-11