产品简介
MOSS-TTS-Nano 是开源多语言语音生成工具,仅0.1B参数,可直接在CPU上运行。它解决了实时语音生成中硬件依赖和部署复杂的问题,适合开发者进行本地演示、Web服务集成和轻量产品部署。
核心功能
- 模型小巧,仅0.1B参数
- 原生支持48kHz双声道音频输出
- 多语言支持,包括中文、英语等20种语言
- 流式推理,低延迟实时生成
- CPU友好,可在4核CPU上运行
快速开始
- 第一步:使用Conda创建并激活环境。
- 第二步:运行infer.py脚本进行语音克隆测试。
- 第三步:启动app.py启动本地Web演示界面。
界面预览


与其他方案对比
| 对比项 | MOSS-TTS-Nano | 同类方案 |
|---|---|---|
| 模型大小 | 仅0.1B参数,轻量级 | 同类模型通常参数更大,占用更多资源 |
| GPU需求 | 无需GPU,可在CPU上实时运行 | 多数TTS模型需要GPU加速才能流畅运行 |
| 部署复杂度 | 部署栈简单,支持本地和Web服务 | 同类方案可能需要复杂配置和依赖 |
适合谁用
- 需要快速部署TTS应用的开发者
- 进行产品原型验证的产品经理
- 希望在本地运行语音生成模型的AI爱好者
下载与版本
当前最新版本为 main,发布于 。支持 Windows、macOS、Linux。
⚠️ 注意:本项目仅提供源代码下载,不包含可直接运行的安装包(exe/dmg/apk 等。下载后需要自行编译构建才能使用,适合有一定开发经验的用户。如果你不熟悉编译流程,建议寻找同类开箱即用的替代方案。
注意事项
- 本工具仅供学习和研究使用,请遵守相关法律法规。
- 请尊重内容创作者版权,勿将下载内容用于商业或非法传播。
- 项目源码地址:https://github.com/OpenMOSS/MOSS-TTS-Nano