
dvlt
nv-tlabs
Official implementation of Déjà View: Looping Transformers for Multi-View 3D Reconstruction
AI 简介
Déjà View(DVLT)是一个基于循环Transformer的多视角三维重建模型,旨在从无序图像集合中联合估计像素级深度、相机位姿、光线方向与置信度。其核心技术是共享参数的帧-全局注意力模块与离散深度索引机制,支持推理时灵活调节迭代步数K,在参数量显著更少的前提下达到或超越大型前馈模型的精度。适用于单目/多视角场景下的稀疏图像三维重建、SLAM辅助建图及NeRF预处理等任务,尤其适合计算资源受限但需高精度几何恢复的视觉重建场景。
Python
Other366
Stars
17
Forks
2
Watchers
3
Issues
Star 增长
今日0
近 7 天0
近 30 天+17
综合评分45.47
默认分支main