DUSt3R
DUSt3R: Geometric 3D Vision Made Easy进阶无需相机参数,直接从两张图回归逐像素三维点图的前馈式重建模型。
DUSt3R 是 Naver Labs Europe 与阿尔托大学的 Shuzhe Wang 等人提出的三维重建模型,发表于 CVPR 2024。传统流程(运动恢复结构 SfM 加多视图立体 MVS)要先估计相机内外参,再三角化匹配点,步骤多且容易失败。DUSt3R 反过来:把两张图送进 Transformer 编码器-解码器,直接为每个像素回归一个三维坐标,称为点图(pointmap),两张图的点都表示在第一张图的相机坐标系里,并附带置信度;深度、像素匹配、相对位姿和焦距都能从点图里读出。多于两张图时,再用全局对齐把各对结果统一到同一坐标系。它是「前馈式三维重建」的代表工作,后续的 MASt3R、VGGT、π³ 等都在这条路线上。代码采用 CC BY-NC-SA 4.0 非商用许可。
例子用手机随手拍两张桌面照片、不做相机标定,DUSt3R 就能输出两张图对应的三维点云和两台相机的相对位姿,可用来快速重建机器人工作台。
- 也叫
- Dense and Unconstrained Stereo 3D Reconstruction
- 相关
- 点图、MASt3R、VGGT、前馈式三维重建、运动恢复结构、多视图立体
- 来源
- arXiv 2312.14132: DUSt3R: Geometric 3D Vision Made Easy
naver/dust3r (GitHub) - 信息截至
- 2024-06