Depth Anything
Depth Anything (V1 / V2)常用港大与 TikTok 推出的单目深度估计基础模型,一张照片就能出深度图。
Depth Anything 是香港大学与 TikTok 研究团队提出的单目深度估计模型系列。V1(CVPR 2024)在约 150 万张有标注图像之外,用约 6200 万张无标注图像做伪标签训练,泛化很强,输出相对深度。V2(NeurIPS 2024)改用合成数据训练大教师模型,再用大规模伪标注真实图像训练学生模型,细节更清晰,提供约 2500 万到 13 亿参数的多个尺寸,另有度量深度微调版;Small 版为 Apache-2.0 许可,更大的版本限非商用。机器人里常用它补足深度相机,为 3D 感知、导航和数据生成提供深度先验。后续有 Depth Anything 3 等。
例子给腕部相机的一帧 RGB 图跑 Depth Anything V2-Small,得到逐像素相对深度,再用少量深度相机测得的点拟合尺度和偏移,恢复出以米为单位的深度。
- 也叫
- Depth Anything V2、Depth Anything V1
- 相关
- 单目深度估计、度量深度 / 相对深度、深度估计、Depth Anything 3、Prompt Depth Anything、视觉基础模型
- 来源
- Depth Anything: Unleashing the Power of Large-Scale Unlabeled Data (arXiv 2401.10891)
Depth Anything V2 (arXiv 2406.09414)
DepthAnything/Depth-Anything-V2(GitHub) - 信息截至
- 2025-01