
UniVidX
houyuanchen111
[SIGGRAPH 2026 / TOG] Official code of the paper "UniVidX: A Unified Multimodal Framework for Versatile Video Generation via Diffusion Priors".
AI 简介
UniVidX 是一个基于扩散先验的统一多模态视频生成框架,支持文本、图像、深度、运动等多种条件输入,实现视频生成与感知任务的一体化建模。其核心技术包括随机条件掩码(SCM)、解耦门控LoRA(DGL)和跨模态自注意力(CMSA),仅需不到1000条训练视频即可高效适配多种视频生成任务。适用于科研探索、多条件可控视频合成、轻量级视频编辑及跨模态视频理解等场景,尤其适合需兼顾生成质量与训练数据效率的研究与应用需求。
Python
249
Stars
10
Forks
1
Watchers
4
Issues
Star 增长
今日0
近 7 天0
近 30 天0
综合评分40.12
默认分支main