腾讯 HY-Embodied(混元具身)
Hy-Embodied series (Tencent Robotics X & Hunyuan: Hy-Embodied-0.5 VLM / VLA / -X)HY-Embodied进阶腾讯 Robotics X 与混元团队开源的具身基础模型系列,含具身 VLM 和 VLA
腾讯 Robotics X 实验室与混元视觉团队推出的开源具身基础模型家族。2026 年 4 月的 HY-Embodied-0.5 是面向机器人的视觉语言模型,强化空间、时间感知和具身推理,采用混合 Transformer(MoT)架构,分 2B 激活(总 4B)的端侧版和 32B 版,开源了 MoT-2B;同月的 0.5-X 在其上继续后训练,侧重任务规划、风险判断等。6 月的 Hy-Embodied-0.5-VLA 在该骨干上加流匹配动作专家,用自研指尖 UMI 采集的 1 万多小时双臂数据训练,开源其中 2000 多小时;7 月又发布 MoE 架构的 VLM-1.0(约 3B 激活 / 30B 总参数)。项目页挂在腾讯 Tairos 具身智能开放平台。
例子Hy-Embodied-0.5-VLA 在 RoboTwin 2.0 仿真基准上报告的成功率为 90.9%(Clean)和 90.1%(Randomized)。
- 也叫
- HY-Embodied-0.5、HY-Embodied-0.5-X、Hy-Embodied-0.5-VLA、HY-VLA-0.5、Hy-Embodied-VLM-1.0
- 相关
- 具身大模型、视觉语言模型、视觉-语言-动作模型、混合 Transformer 架构、通用操作接口、腾讯 Tairos
- 来源
- Tencent-Hunyuan/HY-Embodied (GitHub)
HY-Embodied-0.5: Embodied Foundation Models for Real-World Agents (arXiv 2604.07430)
Tencent-Hunyuan/Hy-Embodied-0.5-VLA (GitHub) - 信息截至
- 2026-07