具身智能新手名词表English

π³(Pi3)

π³: Permutation-Equivariant Visual Geometry Learning进阶

不设参考视角、不受输入顺序影响的前馈式三维重建模型

π³ 是上海人工智能实验室、浙江大学等机构 2025 年 7 月发布的前馈式三维重建模型,仓库标注为 ICLR 2026。此前的 DUSt3R、VGGT 等方法要指定一张图作参考视角,所有结果都放在它的坐标系下,参考图选得不好重建就会变差。π³ 改用完全置换等变的结构(打乱输入顺序,输出只跟着换顺序、内容不变),不需要参考帧,为每张图直接预测仿射不变的相机位姿和尺度不变的局部点图。论文报告在相机位姿估计、单目与视频深度估计、稠密点图重建上达到当时最好水平。2025 年 12 月发布升级版 Pi3X,可输入已知位姿、内参或深度,并给出近似真实尺度。代码为 BSD 协议,权重仅限非商用。

例子把同一组 10 张室内照片按不同顺序输入 π³,得到的点云和相对相机位姿基本一致;以首帧为参考的方法,结果会随首帧的选择而变化。

也叫
Pi3、Pi3X
相关
VGGT、DUSt3R、前馈式三维重建、点图、相机外参、上海人工智能实验室
来源
π³: Permutation-Equivariant Visual Geometry Learning (arXiv)
yyfz/Pi3 (GitHub)
信息截至
2025-12

在完整名词表里查看 →