极佳 GigaBrain-0
GigaBrain-0: A World Model-Powered Vision-Language-Action Model (GigaAI)进阶极佳科技用世界模型生成数据来训练的 VLA 模型系列
极佳科技(GigaAI)2025 年 10 月发布的视觉-语言-动作模型(VLA)。它针对真机数据贵且少的问题,把大量训练数据换成世界模型生成的数据,包括视频生成、外观迁移、人类视频迁移、视角迁移和仿真到真实迁移。模型输入 RGB-D 图像增强空间感,先输出具身思维链(用语言写出中间推理)再出动作,并用知识隔离防止推理训练干扰动作。另有可跑在 Jetson AGX Orin 上的 GigaBrain-0-Small。后续 GigaBrain-0.5 用 1 万多小时真机数据训练,0.5M* 加入基于世界模型的强化学习,2026 年 8 月的 0.7 用 3.7 万多小时数据和三系统架构。
例子论文把训练数据中世界模型生成数据的比例从 0 逐步提到 90%,模型对物体外观、摆放位置和相机视角变化的泛化随之明显提升。
- 也叫
- GigaBrain、GigaBrain-0.5、GigaBrain-0.5M*、GigaBrain-0.7
- 相关
- 极佳科技、极佳 GigaWorld-0、视觉-语言-动作模型、具身思维链、知识隔离、合成数据
- 来源
- GigaBrain-0 (arXiv:2510.19430)
GigaBrain-0.5M* (arXiv:2602.12099)
GigaBrain-0.7 (arXiv:2608.15875) - 信息截至
- 2026-08