mozilla

DeepSpeech

mozilla

DeepSpeech is an open source embedded (offline, on-device) speech-to-text engine which can run in real time on devices ranging from a Raspberry Pi 4 to high power GPU servers.

AI 简介

DeepSpeech 是一个开源的离线语音识别引擎,支持在嵌入式设备(如树莓派)到 GPU 服务器上实时运行。它基于深度学习模型(源自百度 Deep Speech 论文),使用 TensorFlow 实现,提供端到端的语音转文本能力,具备轻量级、低延迟和隐私友好等特性。适用于对数据本地化、网络不可靠或实时性要求高的场景,如智能硬件语音交互、边缘计算语音处理、离线会议转录等。项目已于近期停止维护,但其模型与代码仍可作为离线语音识别的参考实现使用。

C++
Mozilla Public License 2.0
26.8k
Stars
4.1k
Forks
6
Watchers
126
Issues

Star 增长

今日0
近 7 天0
近 30 天+12
综合评分71.2
默认分支master