
kvae-audio
kandinskylab
KVAE-Audio: a continuous full-band audio waveform autoencoder
AI 简介
KVAE-Audio 是一个面向全频带(48 kHz)原始音频波形的连续型自编码器,专注于高保真压缩与重建。其核心特点是采用连续潜在空间设计,支持语音、音乐及环境音等多类型音频的紧凑表征,并专为下游生成任务(如文本到音频)提供高质量、语义友好的latent接口;技术上基于深度概率建模,兼顾重建精度与生成兼容性。适用于需要低维连续音频表征的研究场景,如可控音频生成、声学特征学习、语音/音乐编辑及生成模型的autoencoder替换优化。
Python
MIT License90
Stars
4
Forks
3
Watchers
0
Issues
Star 增长
今日0
近 7 天0
近 30 天0
综合评分42.1
默认分支main