具身智能新手名词表English

达摩院 RynnBrain

RynnBrain: Open Embodied Foundation Models (Alibaba DAMO)进阶

阿里达摩院开源的具身「大脑」模型,负责看懂第一视角画面、定位物体和做任务规划

阿里巴巴达摩院 2026 年 2 月开源,定位是给机器人当「大脑」的时空基础模型,而不是直接输出电机指令的策略。它把四种能力放进一个模型:第一视角视频理解、在视频里定位物体和可操作部位的时空定位、结合物理常识的推理,以及任务规划。1.0 版有 2B、8B 和 30B-A3B 三种规模(后者是混合专家模型,总参数 30B、每次约激活 3B),并后训练出 RynnBrain-Nav(导航)、-Plan(规划)、-VLA(动作)和面向空间推理的 -CoP 等版本,同时发布评测基准 RynnBrain-Bench。2026 年 7 月的 1.1 版以 Qwen3.5 为底座,规模扩到 2B、9B 和 122B-A10B(最大的是混合专家模型),新增接触点预测,2B 和 9B 版还支持原生 3D 定位;官方称最大模型在 VSI-Bench、MMSI、RefSpatial-Bench 三个空间推理基准上超过所评测的闭源和开源模型。代码和权重以 Apache 2.0 协议开放。

例子收到「把桌上的杯子放进水槽」时,RynnBrain 先在第一视角画面里标出杯子和水槽的位置,再拆出「走到桌边、抓起杯子、走到水槽、放下」几步,交给下层动作模型执行。

也叫
RynnBrain 1.0、RynnBrain 1.1
相关
阿里达摩院、具身大模型、具身推理模型、大脑-小脑架构(大小脑)、达摩院 RynnVLA-002、混合专家模型
来源
alibaba-damo-academy/RynnBrain (GitHub)
RynnBrain: Open Embodied Foundation Models (arXiv 2602.14979)
RynnBrain 1.1: Towards More Capable and Generalizable Embodied Foundation Model (arXiv 2607.17977)
信息截至
2026-07

在完整名词表里查看 →