英伟达 Alpamayo(驾驶推理 VLA)
NVIDIA DRIVE Alpamayo-R1 / Alpamayo 1 (open reasoning VLA for autonomous driving)AR1进阶英伟达开放的自动驾驶推理 VLA,先用文字讲清为什么这样开,再输出行驶轨迹。
Alpamayo-R1 是英伟达的自动驾驶视觉-语言-动作模型,论文 2025 年 10 月底上 arXiv,12 月在 Hugging Face 开放权重,2026 年 1 月 CES 上改名 Alpamayo 1,与仿真框架 AlpaSim、1700 多小时的开放驾驶数据一起发布。它针对罕见的长尾路况:只模仿轨迹容易在没见过的场景出错,于是让模型先写出「因果链」推理(看到什么、所以怎么做),再生成轨迹。开放版以 Cosmos-Reason 视觉语言模型为骨干(8.2B),加 2.3B 的扩散式动作专家,输入 4 路相机画面和自车运动历史,输出未来 6.4 秒轨迹。论文报告难场景规划精度最多提升 12%,闭环仿真中近距离险情减少 35%,车上延迟约 99 毫秒。
例子遇到前方车道被施工锥桶封住时,模型会先输出一段说明(如前方车道封闭、需减速并变道绕行),再给出与之对应的 6.4 秒行驶轨迹,工程师可对照文字检查它为什么这样开。
- 也叫
- Alpamayo-R1、Alpamayo 1、Alpamayo-R1-10B
- 相关
- 视觉-语言-动作模型、自动驾驶、思维链、Cosmos Reason、动作专家、长尾问题
- 来源
- Alpamayo-R1: Bridging Reasoning and Action Prediction for Generalizable Autonomous Driving in the Long Tail (arXiv 2511.00088)
NVlabs/alpamayo GitHub 仓库(Alpamayo 1)
NVIDIA Announces Alpamayo Family of Open-Source AI Models(NVIDIA Newsroom,2026-01-05) - 信息截至
- 2026-01