产品推荐 2026-07-21

Multilingual_Text_to_Speech:多语

支持多语言、代码切换和声音克隆的文本转语音工具。

开源软件实用工具

产品简介

Multilingual_Text_to_Speech 面向中文用户的多语言文本转语音工具,基于 Tacotron 2 实现。支持代码切换和声音克隆,适用于需要合成多种语言语音的研究人员和开发者。提供预训练模型和交互式演示,简化多语言语音合成流程。

核心功能

  • 多语言文本转语音合成
  • 支持代码切换(混合语言)
  • 声音克隆功能
  • 参数共享优化训练效率
  • 提供预训练模型和交互式演示

快速开始

  1. 第一步:克隆仓库:git clone https://github.com/Tomiinek/Multilingual_Text_to_Speech.git
  2. 第二步:安装 Python 依赖:pip3 install -r requirements.txt
  3. 第三步:下载数据集:CSS10 和 Common Voice 数据集
  4. 第四步:准备光谱图:运行 python3 prepare_css_spectrograms.py
  5. 第五步:训练模型:运行 python3 train.py --hyper_parameters generated_switching

界面预览

与其他方案对比

对比项Multilingual_Text_to_Speech同类方案
语言支持数量支持多种语言(基于 CSS10 数据集)可能仅支持单一或少数语言
代码切换功能内置支持代码切换,无需额外处理可能不支持或需要自定义实现
声音克隆能力支持声音克隆,可复制特定说话人音色通常不具备声音克隆功能

适合谁用

  • 需要多语言语音合成的研究人员
  • 开发多语言语音应用的开发者
  • 学习语音合成技术的学生
  • 需要代码切换语音的教育软件开发者

下载与版本

当前最新版本为 v1.0,发布于 2020-05-26。支持 多平台。点击页面「下载软件」按钮即可下载打包好的版本,根据你的电脑/手机系统来选择对应的软件。

注意事项