fudan-generative-vision

hallo

fudan-generative-vision

Hallo: Hierarchical Audio-Driven Visual Synthesis for Portrait Image Animation

AI 简介

Hallo是一个基于音频驱动的肖像图像动画生成模型,可将静态人像图与语音音频输入结合,生成口型、表情和头部动作自然同步的说话视频。项目采用分层建模架构,融合音频特征编码、面部关键点引导与扩散模型生成技术,在保持身份一致性的前提下实现高保真动态合成。支持单张人脸图像输入,无需训练或微调即可生成高质量短视频,适用于虚拟数字人、在线教育讲师动画、影视修复及无障碍内容生成等场景。

Python
MIT License
8.7k
Stars
1.1k
Forks
449
Watchers
114
Issues

Star 增长

今日0
近 7 天0
近 30 天+1
综合评分65.25
默认分支main