
EMO
HumanAIGC
Emote Portrait Alive: Generating Expressive Portrait Videos with Audio2Video Diffusion Model under Weak Conditions
AI 简介
EMO是一个基于扩散模型的音频驱动肖像视频生成项目,旨在仅需单张静态人像图和语音音频即可生成表情丰富、口型同步的说话视频。其核心技术采用弱条件下的Audio2Video扩散架构,支持低质量输入(如低分辨率图像或含噪音频),并兼顾表情动态性与身份保真度。项目适用于虚拟数字人、在线教育讲师视频生成、无障碍语音可视化、短视频内容创作等需要快速将语音转化为具表现力人像视频的场景。
7.6k
Stars
930
Forks
327
Watchers
246
Issues
Star 增长
今日0
近 7 天0
近 30 天0
综合评分61.91
默认分支main