HumanAIGC

EMO

HumanAIGC

Emote Portrait Alive: Generating Expressive Portrait Videos with Audio2Video Diffusion Model under Weak Conditions

AI 简介

EMO是一个基于扩散模型的音频驱动肖像视频生成项目,旨在仅需单张静态人像图和语音音频即可生成表情丰富、口型同步的说话视频。其核心技术采用弱条件下的Audio2Video扩散架构,支持低质量输入(如低分辨率图像或含噪音频),并兼顾表情动态性与身份保真度。项目适用于虚拟数字人、在线教育讲师视频生成、无障碍语音可视化、短视频内容创作等需要快速将语音转化为具表现力人像视频的场景。

7.6k
Stars
930
Forks
327
Watchers
246
Issues

Star 增长

今日0
近 7 天0
近 30 天0
综合评分61.91
默认分支main