
audio.cpp
0xShug0
An all-in-one, pure C++ inference engine for audio models, powered by ggml. Supports TTS, STT, VAD, voice conversion, music generation, and more, with highly optimized performance. No Python dependency.
AI 简介
audio.cpp 是一个基于 ggml 的纯 C++ 音频模型推理引擎,支持语音合成(TTS)、语音识别(ASR)、声源活动检测(VAD)、语音转换、音乐生成、说话人日志(diarization)等多任务。其核心特点是零 Python 依赖、CUDA 高度优化(端到端延迟降低 45%–80%)、内置音频预处理工具(降噪、重采样、STFT),并提供 CLI 和服务化接口及实验性 JSON 流水线支持。适用于对低延迟、可嵌入、跨平台部署有要求的本地化音频 AI 应用场景,如边缘设备语音助手、离线语音服务、实时语音处理系统。
C++
Other487
Stars
39
Forks
10
Watchers
9
Issues
Star 增长
今日0
近 7 天0
近 30 天0
综合评分44.81
默认分支release-0.1