
Audio-Interaction
xzf-thu
暂无描述
AI 简介
Audio Interaction Model 是首个通用流式音频语言模型,支持离线与实时流式音频处理的统一建模。核心功能包括语音识别(ASR)、语音到文本翻译(S2TT)、音频问答(AQA)等离线任务,以及实时语音对话、流式指令跟随和主动交互等在线能力;技术上采用端到端流式架构,支持持续监听、决策与响应,实现“始终在线、主动响应”的音频交互范式。适用于智能助手、实时会议转录、无障碍交互设备及需要低延迟语音理解与生成的嵌入式或边缘场景。
Python
566
Stars
31
Forks
14
Watchers
6
Issues
Star 增长
今日0
近 7 天0
近 30 天+12
综合评分43.72
默认分支main