kigner

audio.cpp-webui

kigner

audio.cpp with a full-task WebUI - pure C++ audio-model inference engine powered by ggml. TTS, ASR/STT, VAD, voice conversion, speaker diarization, music generation. No Python dependency.

AI 简介

audio.cpp-webui 是一个基于 C++ 和 ggml 的纯本地音频模型推理引擎,提供 Web 界面支持多任务音频处理。核心功能涵盖语音识别(ASR/STT)、文本转语音(TTS)、语音活动检测(VAD)、说话人分离(diarization)、语音转换与音乐生成,全部无需 Python 依赖。技术特点包括 CUDA 加速优化、低延迟流式推理、跨平台可移植性及内置音频预处理工具。适用于离线环境下的实时语音交互、会议转录、播客生成、边缘设备部署等对性能与隐私有较高要求的场景。

C++
Other
173
Stars
45
Forks
2
Watchers
0
Issues

Star 增长

今日0
近 7 天+54
近 30 天+54
综合评分70.39
默认分支release-0.1