
mimo-tts-studio
Chentx1243
基于XiaoMi-Mimo-V2.5TTS系列模型的音频工作站,允许您通过工作流的方式,轻松实现音色克隆与音色创造
AI 简介
这是一个基于小米MiMo-V2.5 TTS模型的可视化音频工作站,支持通过节点化工作流实现语音克隆与语音设计。核心功能包括拖拽式React Flow节点编辑、参考音频驱动的音色克隆、纯文本描述驱动的音色生成、AI辅助的风格提示优化、智能工作流生成及多工作区管理,并可打包为Electron桌面应用。适用于语音内容创作者、AIGC开发者、播客制作者及需要快速定制合成语音的本地化音频生产场景。
TypeScript
55
Stars
13
Forks
27
Watchers
0
Issues
Star 增长
今日0
近 7 天0
近 30 天+6
综合评分41.04
默认分支main