
voice_clone_lab
tetsuo-ai
Clone a voice from a few minutes of audio and generate speech locally — Qwen3-TTS fine-tuning pipeline with CLI and web UI
AI 简介
Voice Clone Lab 是一个本地化语音克隆工具,支持仅用几分钟音频即可微调 Qwen3-TTS 模型,生成高质量个性化语音。核心功能包括多源音频接入(本地文件、麦克风录制、YouTube 链接)、端到端自动化流水线(语音提取、降噪、分段、WhisperX 转录与可编辑校对)、零样本即时试听,以及 CLI 与 Gradio Web UI 双交互模式。所有数据全程离线处理,模型与音频不上传。适用于个人语音备份、无障碍内容生成、本地化配音原型开发等需隐私保护与可控训练的场景。
Python
Apache License 2.0132
Stars
18
Forks
1
Watchers
0
Issues
Star 增长
今日0
近 7 天0
近 30 天0
综合评分43.84
默认分支main