
zipEnhancer
gyj1201
将 ZipEnhancer 模型从 ModelScope pipeline 中剥离,用纯 PyTorch 实现推理流程,封装为 pip 可安装的降噪库和 FastAPI 批量语音降噪,为 CosyVoice 提供干净的人声输入。
AI 简介
ZipEnhancer 是一个轻量级语音降噪工具库,基于 PyTorch 实现 ZipEnhancer、FRCRN 和 MossFormer2 三类模型的纯框架推理,支持 GPU 加速的单文件/批量音频降噪。核心特点包括:脱离 ModelScope 黑盒 pipeline、FP16 模型计算+FP32 STFT 避免精度损失、4s 滑动窗口重叠加法处理任意长度音频、保持原始声道数与位深(如立体声/16-bit PCM)。适用于会议录音后处理、语音识别预处理、播客素材清洁等对人声保真度和实时性要求较高的语音工程场景。
Python
MIT License123
Stars
6
Forks
4
Watchers
1
Issues
Star 增长
今日0
近 7 天0
近 30 天+1
综合评分42.64
默认分支master