
Depth-Anything-V2
DepthAnything
[NeurIPS 2024] Depth Anything V2. A More Capable Foundation Model for Monocular Depth Estimation
AI 简介
Depth Anything V2 是一个面向单目深度估计的通用基础模型,旨在从单张RGB图像中高效、鲁棒地预测像素级相对深度图。其核心特点包括:基于ViT架构的轻量设计(最小模型仅24.8M参数)、显著优于前代V1的细节还原与泛化能力、比扩散模型更快的推理速度和更高精度,同时支持Hugging Face Transformers集成与Apple Core ML部署。项目提供Small/Base/Large/XL四档模型,并扩展至视频深度估计(Video Depth Anything)和带LiDAR提示的4K度量深度(Prompt Depth Anything)。适用于机器人导航、AR/VR场景理解、3D重建、自动驾驶感知等需低成本单目深度推断的视觉任务。
Python
Apache License 2.08.6k
Stars
895
Forks
56
Watchers
221
Issues
Star 增长
今日0
近 7 天0
近 30 天0
综合评分64.86
默认分支main