
FluidAudio
FluidInference
Frontier CoreML audio models in your apps — text-to-speech, speech-to-text, voice activity detection, and speaker diarization. In Swift, powered by SOTA open source.
AI 简介
FluidAudio 是一个面向 Apple 生态的 Swift SDK,提供完全本地运行的音频 AI 功能,包括语音转文字(ASR)、文本转语音(TTS)、语音活动检测(VAD)和说话人日志(speaker diarization)。其核心基于优化的 CoreML 模型,推理任务卸载至 Apple Neural Engine(ANE),显著降低 CPU 占用与内存开销,支持后台持续处理与低延迟实时场景。所有模型均来自开源社区(MIT/Apache 2.0 许可),经适配与量化后可在 iOS 和 macOS 设备上离线运行。适用于需隐私优先、无网络依赖或持续监听的本地化音频应用,如会议记录、无障碍交互、语音笔记及边缘端语音分析工具。
Swift
Apache License 2.02.6k
Stars
367
Forks
43
Watchers
9
Issues
Star 增长
今日0
近 7 天0
近 30 天0
综合评分59.7
默认分支main