产品推荐 2026-07-25

MOSS-TTS-Nano:免费的多语言语音生成工具(源码)

MOSS-TTS-Nano是一款轻量级多语言语音生成模型,无需GPU即可实时生成语音。

开源软件跨平台工具

产品简介

MOSS-TTS-Nano 是开源多语言语音生成工具,仅0.1B参数,可直接在CPU上运行。它解决了实时语音生成中硬件依赖和部署复杂的问题,适合开发者进行本地演示、Web服务集成和轻量产品部署。

MOSS-TTS-Nano 主界面

核心功能

  • 模型小巧,仅0.1B参数
  • 原生支持48kHz双声道音频输出
  • 多语言支持,包括中文、英语等20种语言
  • 流式推理,低延迟实时生成
  • CPU友好,可在4核CPU上运行

快速开始

  1. 第一步:使用Conda创建并激活环境。
  2. 第二步:运行infer.py脚本进行语音克隆测试。
  3. 第三步:启动app.py启动本地Web演示界面。

界面预览

MOSS-TTS-Nano 界面截图

MOSS-TTS-Nano 界面截图

与其他方案对比

对比项MOSS-TTS-Nano同类方案
模型大小仅0.1B参数,轻量级同类模型通常参数更大,占用更多资源
GPU需求无需GPU,可在CPU上实时运行多数TTS模型需要GPU加速才能流畅运行
部署复杂度部署栈简单,支持本地和Web服务同类方案可能需要复杂配置和依赖

适合谁用

  • 需要快速部署TTS应用的开发者
  • 进行产品原型验证的产品经理
  • 希望在本地运行语音生成模型的AI爱好者

下载与版本

当前最新版本为 main,发布于 。支持 Windows、macOS、Linux。

⚠️ 注意:本项目仅提供源代码下载,不包含可直接运行的安装包(exe/dmg/apk 等。下载后需要自行编译构建才能使用,适合有一定开发经验的用户。如果你不熟悉编译流程,建议寻找同类开箱即用的替代方案。

注意事项

  • 本工具仅供学习和研究使用,请遵守相关法律法规。
  • 请尊重内容创作者版权,勿将下载内容用于商业或非法传播。
  • 项目源码地址:https://github.com/OpenMOSS/MOSS-TTS-Nano