Robbyant

lingbot-video

Robbyant

Scaling Mixture-of-Experts Video Pretraining for Embodied Intelligence

AI 简介

LingBot-Video 是一个面向具身智能的开源视频生成模型,基于大规模混合专家(MoE)架构实现高效视频预训练。核心功能包括文本/图像到视频生成(T2V/TI2V)、物理合理性建模、美学与任务完成多目标奖励优化,并支持Prompt重写增强输入质量。技术特点涵盖30B参数MoE主干、7万+小时具身数据训练、约3倍加速推理及端到端可微调设计。适用于机器人仿真、虚拟环境构建、具身AI训练世界模型等需要高保真、物理可信视频合成的研究与开发场景。

Python
Apache License 2.0
778
Stars
30
Forks
2
Watchers
4
Issues

Star 增长

今日0
近 7 天0
近 30 天+263
综合评分58.47
默认分支master