
lingbot-vla-v2
Robbyant
From Foundation to Application
AI 简介
LingBot-VLA 2.0 是一个面向真实机器人应用的视觉-语言-动作(VLA)基础模型。它通过融合50,000小时多构型机器人轨迹与10,000小时第一人称人类视频数据,支持跨任务、跨本体泛化;扩展了涵盖机械臂、灵巧手、移动底盘等多模态动作空间;并引入基于DINO-Video和LingBot-Depth的预测式动力学建模机制。适用于具身智能研究、服务机器人任务规划、端到端机器人控制等需要视觉理解、语言指令解析与连续动作生成协同的场景。
Python
Apache License 2.0501
Stars
33
Forks
112
Watchers
1
Issues
Star 增长
今日0
近 7 天0
近 30 天+241
综合评分58.59
默认分支main