具身智能新手名词表English

MapAnything

MapAnything: Universal Feed-Forward Metric 3D Reconstruction进阶

Meta 与 CMU 的通用前馈三维重建模型,直接输出带真实尺度的场景结构。

MapAnything 由 Meta Reality Labs 与卡内基梅隆大学在 2025 年 9 月发布,是基于 Transformer 的前馈式三维重建模型:输入一张或多张图片,还可按需附上相机内参、位姿、深度或部分重建结果,一次前向计算就输出每张图的深度图、局部射线图、相机位姿和统一的度量尺度因子,合起来就是带米制尺度的三维场景。过去未标定运动恢复结构、多视图立体、单目深度估计、相机定位、深度补全等任务各用一套算法,它用一个模型全部覆盖。它与 DUSt3R、VGGT 属于同一条前馈重建路线,代码和权重已开源(含 Apache 协议版本)。对机器人来说,可以从几张照片快速得到能直接用于规划的米制点云。

例子用手机围着桌面拍几张照片、不给任何相机参数,MapAnything 就能输出带米制尺度的点云和每张照片的相机位姿;如果已知相机内参,也可以一并输入作为约束。

也叫
Map Anything
相关
前馈式三维重建、DUSt3R、VGGT、MASt3R、运动恢复结构、度量深度 / 相对深度
来源
arXiv: MapAnything: Universal Feed-Forward Metric 3D Reconstruction
MapAnything 项目主页
信息截至
2026-01

在完整名词表里查看 →