具身智能新手名词表English

原力灵机 DM0

DM0: An Embodied-Native Vision-Language-Action Model towards Physical AI (Dexmal)进阶

原力灵机 2026 年开源的「具身原生」VLA,预训练阶段就混入驾驶和机器人数据。

DM0 是原力灵机(Dexmal)联合阶跃星辰于 2026 年 2 月发布并开源的视觉-语言-动作模型(VLA)。多数 VLA 先用只见过互联网图文的视觉语言模型,再拿机器人数据微调;DM0 主张「具身原生」,预训练时就把网页文本、自动驾驶场景和机器人交互日志一起训练(约 1.2 万亿 token)。训练分三段:预训练统一的 VLM(语言部分基于 Qwen3-1.7B),中训练在其上加一个流匹配动作专家(专门输出连续动作的子网络),后训练用混合策略精调。训练具身数据时,动作专家的梯度不回传给 VLM,以保住通用理解能力;还用空间思维链先推理空间关系再出动作。模型约 20 亿参数,统一支持操作和导航。2026 年 7 月原力灵机推出约 60 亿参数的后续版本 DM0.5,配套开源框架 OpenDM。

例子据论文报告,DM0 在 RoboChallenge Table30 真机基准上,专用设置平均成功率 62.0%、通用设置 37.3%,发布时两项均排第一。

也叫
DM0.5、Dexmal DM0
相关
视觉-语言-动作模型、动作专家、流匹配、中训练、RoboChallenge、Dexbotic
来源
DM0: An Embodied-Native Vision-Language-Action Model towards Physical AI (arXiv 2602.14974)
Dexmal/DM05 模型卡(Hugging Face)
Dexbotic 代码仓库(GitHub)
信息截至
2026-09

在完整名词表里查看 →