
speechbrain
speechbrain
A PyTorch-based Speech Toolkit
AI 简介
SpeechBrain 是一个基于 PyTorch 的开源语音处理工具包,专注于简化端到端 Conversational AI 系统的开发。它提供统一框架支持语音识别(ASR)、说话人日志(diarization)、说话人验证、语音增强、语音分离、语音转文本、语言建模等20余项任务,并内置200+可复现训练脚本及对 Whisper、Wav2Vec2、HuBERT 等主流预训练模型的集成支持。项目采用模块化设计,强调易用性与可扩展性,适合学术研究、语音系统原型开发及工业级语音应用快速迭代。
Python
Apache License 2.0asraudioaudio-processingdeep-learninghuggingfacelanguage-modelpytorchspeaker-diarizationspeaker-recognitionspeaker-verificationspeech-enhancementspeech-processingspeech-recognitionspeech-separationspeech-to-textspeech-toolkitspeechrecognitionspoken-language-understandingtransformersvoice-recognition
11.7k
Stars
1.7k
Forks
138
Watchers
126
Issues
Star 增长
今日0
近 7 天0
近 30 天0
综合评分44.7
默认分支develop