OpenMOSS

MOSS-TTS

OpenMOSS

MOSS‑TTS Family is an open‑source speech and sound generation model family from MOSI.AI and the OpenMOSS team. It is designed for high‑fidelity, high‑expressiveness, and complex real‑world scenarios, covering stable long‑form speech, multi‑speaker dialogue, voice/character design, environmental sound effects, and real‑time streaming TTS.

AI 简介

MOSS-TTS 是一个开源的语音与声音生成模型家族,专注于高保真度、高表现力及复杂现实场景下的音频合成。核心功能包括稳定长文本语音合成、多说话人对话生成、角色/音色定制、环境音效生成以及实时流式TTS;技术上融合多模态建模与音频标记化(audio tokenizer),支持灵活部署与低延迟推理。适用于有声书制作、虚拟助手开发、游戏音效生成、AI配音及交互式语音应用等需要高质量、多样化语音输出的场景。

Python
Apache License 2.0
3.7k
Stars
325
Forks
18
Watchers
9
Issues

Star 增长

今日0
近 7 天0
近 30 天+101
综合评分69.54
默认分支main