
Odyseus-Spatial-VLM
MercuriusTech
暂无描述
AI 简介
Odyseus Spatial VLM 是一个将视觉语言模型(VLM)与单目深度估计能力融合的空间感知系统,支持从自然语言指令和单张图像中联合推理出2D目标区域并生成对应3D空间坐标。其核心基于VLM理解语义指令、Depth-Anything-3(DA3)提供稠密度图,并通过深度采样与几何投影实现像素级到3D点云的映射,最终在Three.js中可视化目标位置、相机视锥与引导向量。适用于具身AI、机器人导航、AR交互等需将语言指令锚定至物理空间的场景。
Python
77
Stars
5
Forks
75
Watchers
0
Issues
Star 增长
今日0
近 7 天0
近 30 天+1
综合评分2.33
默认分支main