产品简介
ai-voice-cloning 基于Tortoise TTS的AI语音克隆工具,增强了多语言训练、Hifigan快速推理、whisper-v3和RVC输出转换功能。适合需要定制语音模型的开发者和内容创作者,解决原版语言支持有限和推理速度慢的问题。
核心功能
- 支持多语言训练
- Hifigan加速推理
- whisper-v3语音识别选项
- RVC输出转换
- 基于Tortoise TTS的语音克隆
快速开始
- 第一步:访问GitHub releases页面下载最新v3.0安装包
- 第二步:使用7zip解压下载的文件
- 第三步:运行start.bat脚本启动工具
界面预览
与其他方案对比
| 对比项 | ai-voice-cloning | 同类方案 |
|---|---|---|
| 语言支持 | 支持多种语言训练 | 原版Tortoise TTS主要支持英语 |
| 推理速度 | 通过Hifigan实现快速推理 | 原版推理速度较慢 |
| 输出功能 | 集成RVC进行语音转换 | 原版无RVC输出选项 |
适合谁用
- 追求开源、免费、无广告体验的用户
- 重视数据隐私,希望本地化处理的用户
- 需要跨平台一致体验的进阶用户
下载与版本
当前最新版本为 v3.0,发布于 2024-04-23。支持 Windows、macOS、Linux。
⚠️ 注意:本项目仅提供源代码下载,不包含可直接运行的安装包(exe/dmg/apk 等。下载后需要自行编译构建才能使用,适合有一定开发经验的用户。如果你不熟悉编译流程,建议寻找同类开箱即用的替代方案。
注意事项
- 本工具仅供学习和研究使用,请遵守相关法律法规。
- 请尊重内容创作者版权,勿将下载内容用于商业或非法传播。
- 项目源码地址:https://github.com/JarodMica/ai-voice-cloning