
vggt
facebookresearch
[CVPR 2025 Best Paper Award] VGGT: Visual Geometry Grounded Transformer
AI 简介
VGGT 是一个面向视觉几何理解的新型视觉 Transformer 模型,旨在将图像中的几何结构(如点、线、面、对称性、透视关系等)显式建模并融入 Transformer 架构中。其核心特点是引入可微分几何先验模块,支持端到端训练,并在深度估计、单目三维重建、相机姿态估计等任务上实现显著性能提升。模型支持多帧输入与长序列处理,经内存优化后推理效率大幅提高。适用于需要强几何感知能力的计算机视觉任务,尤其适合自动驾驶、机器人导航、AR/VR 等对空间结构理解要求高的场景。
Python
Other14.2k
Stars
1.5k
Forks
479
Watchers
249
Issues
Star 增长
今日0
近 7 天0
近 30 天0
综合评分69.55
默认分支main