jixiaozhong

Sonic

jixiaozhong

Official implementation of "Sonic: Shifting Focus to Global Audio Perception in Portrait Animation"

AI 简介

Sonic 是一个面向人像动画生成的音频驱动口型与表情同步模型,旨在提升全局音频感知能力以实现更自然的语音-动作对齐。其核心功能包括端到端的音频到人像视频生成、支持单张静态人像输入与任意语音输入、具备良好的跨说话人泛化性,并采用轻量级架构适配实时推理。项目基于PyTorch实现,提供Gradio在线演示与ComfyUI插件支持。适用于虚拟数字人驱动、教育类AI讲师生成、短视频口播内容自动化制作等需要高质量语音驱动人像动画的非商业场景。

Python
Other
3.3k
Stars
290
Forks
55
Watchers
66
Issues

Star 增长

今日0
近 7 天0
近 30 天+8
综合评分60.19
默认分支main