
Hy-Embodied-0.5-VLA
Tencent-Hunyuan
From Vision-Language-Action Models to a Real-World Robot Learning Stack
AI 简介
Hy-Embodied-0.5-VLA 是一个面向真实机器人部署的端到端视觉-语言-动作(VLA)学习系统。它覆盖完整机器人学习栈,包括多模态数据采集(基于光学动捕的指尖接口,超1万小时UMI演示)、模型架构设计(融合flow-matching动作专家、紧凑历史记忆编码器与解耦运动学的delta-chunk动作表征)、预训练、监督微调及强化学习后训练。项目基于Hy-Embodied-0.5 MoT骨干网络,支持跨实体泛化,在RoboTwin 2.0基准上达到90.9%清洁场景成功率,适用于具身智能研发、机器人技能迁移与真实环境闭环控制等研究与工程场景。
Python
Other201
Stars
16
Forks
2
Watchers
5
Issues
Star 增长
今日0
近 7 天0
近 30 天+26
综合评分46.29
默认分支main