
open-audio-opd
AutoArk
Industrial audio online policy distillation (OPD) training stack for ASR and TTS, distilling compact audio models from stronger teacher models.
AI 简介
open-audio-opd 是一个面向工业级语音任务的在线策略蒸馏(OPD)训练框架,专注于将大型教师模型的知识高效迁移至轻量级学生模型。核心功能包括基于在线 rollout 的 ASR 模型蒸馏、教师-学生协同评分机制、token 级 KL 散度损失计算,并集成 FSDP2 分布式训练、梯度裁剪与检查点管理。当前支持自动语音识别(ASR),TTS 蒸馏已在规划中。适用于需在资源受限设备部署高性能语音模型的场景,如边缘端实时转录、低延迟语音交互系统及模型压缩研发。
Python
Other600
Stars
42
Forks
45
Watchers
0
Issues
Star 增长
今日0
近 7 天0
近 30 天+279
综合评分58.9
默认分支master