
echomimic
antgroup
[AAAI 2025] EchoMimic: Lifelike Audio-Driven Portrait Animations through Editable Landmark Conditioning
AI 简介
EchoMimic 是一个基于音频驱动的人像动画生成模型,支持通过可编辑的关键点条件控制实现逼真、可控的说话人面部动画合成。其核心技术采用可编辑的 landmark conditioning 机制,兼顾生成质量与动作可控性,并提供 V1/V2/V3 多版本演进,支持从单帧人像到半身动画的扩展;推理速度经优化提升达10倍。适用于虚拟数字人、在线教育口型同步、视频会议虚拟形象、短视频内容生成等需高质量语音驱动人脸动画的场景。
Python
Apache License 2.04.3k
Stars
461
Forks
48
Watchers
111
Issues
Star 增长
今日0
近 7 天0
近 30 天+8
综合评分60.79
默认分支main