
realtime-vla-flash
dexmal
暂无描述
AI 简介
Realtime-VLA FLASH 是一个面向视觉-语言-动作(VLA)模型的实时推测推理(speculative inference)框架,专为扩散型VLA模型设计。其核心功能包括:基于VLM对齐的轻量级草案模型架构、针对Triton优化的定制化内核、以及支持双视角输入下仅7.8ms延迟的高速推理,实测达125+ Hz帧率,并在任务层面平均提速3.04倍。项目采用模块化部署设计,兼容LIBERO等机器人操作基准测试环境,适用于需要低延迟闭环控制的具身智能场景,如仿真或真实机器人实时策略执行。
Python
Apache License 2.087
Stars
7
Forks
69
Watchers
0
Issues
Star 增长
今日0
近 7 天0
近 30 天+2
综合评分39.91
默认分支main