CUT3R
CUT3R: Continuous 3D Perception Model with Persistent State进阶带持续记忆状态的 3D 重建模型,逐帧读图、在线更新整个场景。
CUT3R 全称 Continuous Updating Transformer for 3D Reconstruction,由 UC Berkeley 和 Google DeepMind 的研究者提出,是 CVPR 2025 口头报告论文。它沿用 DUSt3R 一类「直接从图像回归点图」(每个像素对应一个 3D 点)的思路,但多了一个持续更新的状态:每进来一张图,模型先用它更新状态,再输出这张图在统一坐标系下、带真实尺度的点图,重建随输入增多逐步完善,不需要针对每段视频做优化。它既能处理视频流,也能处理无序照片,支持有运动物体的动态场景,还能在没拍到的虚拟视角上推测看不见的区域。
例子把机器人头部相机拍的视频逐帧喂给 CUT3R,每来一帧就得到一张对齐到同一坐标系的点图,累积起来就是一份不断变完整的房间点云。
- 也叫
- Continuous Updating Transformer for 3D Reconstruction
- 相关
- DUSt3R、点图、前馈式三维重建、4D重建、VGGT、MASt3R-SLAM
- 来源
- Continuous 3D Perception Model with Persistent State (arXiv 2501.12387)
CUT3R project page - 信息截至
- 2025-06