具身智能新手名词表English

Helix

Figure Helix (Vision-Language-Action model)入门必知

Figure AI 2025 年发布的人形机器人 VLA,用快慢双系统控制整个上半身。

Helix 是美国人形机器人公司 Figure AI 于 2025 年 2 月 20 日发布的视觉-语言-动作模型(VLA,看画面、听指令、直接输出动作的模型),用在自家 Figure 人形机器人上。它采用快慢双系统:System 2 是 70 亿参数的视觉语言模型,以 7–9Hz 理解场景和语言,把意图压成一个隐向量;System 1 是 8000 万参数的 Transformer,以 200Hz 把这个隐向量和实时感知转成动作。它一次控制 35 个自由度的整个上半身,包括手腕、每根手指、躯干和头部朝向。Figure 称训练只用了约 500 小时遥操作数据,一套权重覆盖多种任务、不做任务专门微调,两个系统分别跑在机载的两块低功耗嵌入式 GPU 上。后续有 Helix 02 等版本。

例子发布演示中,两台 Figure 机器人按语言指令协作收纳一袋从没见过的杂货,把物品分别放进冰箱和抽屉。

也叫
Figure Helix、Helix VLA
相关
快慢双系统、视觉-语言-动作模型、Figure AI、Helix 02、Figure 02
来源
Helix: A Vision-Language-Action Model for Generalist Humanoid Control (Figure AI)
信息截至
2025-02

在完整名词表里查看 →