产品简介
supertonic Supertonic是一款基于ONNX运行的文本转语音工具,所有处理均在您的设备(Windows/macOS/Linux)上本地完成,无需联网,保障隐私。它具备低延迟、多语言支持和生成高质量音频的能力,适合注重隐私安全、需要在边缘设备或离线环境中进行语音合成的用户或开发者。
核心功能
- 闪电般快速,低延迟实时语音合成
- 支持31种语言的多语言文本转语音
- 模型轻量(99M参数),下载快、启动快、占用内存低
- 可在桌面、移动设备、浏览器及树莓派等资源受限的硬件上本地运行
- 直接输出44.1kHz 16-bit的高质量WAV音频
快速开始
- 通过 `pip install supertonic` 命令安装Python SDK。
- 在代码中导入并创建TTS实例。
- 调用`synthesize`方法并传入文本和参数,即可生成并保存音频文件。
界面预览
与其他方案对比
| 对比项 | supertonic | 同类方案 |
|---|---|---|
| 部署与隐私 | 完全设备端运行,无需网络连接,无隐私数据泄露风险。 | 多数商业TTS服务需要联网调用云端API,用户数据需离开本地设备。 |
| 资源占用与启动 | 模型仅99M参数,下载快,冷启动快,可在无GPU的普通设备上运行。 | 部分开源TTS模型参数量达0.7B-2B级别,对硬件和内存要求更高。 |
| 语言支持 | 单模型支持31种语言,无需切换适配器,支持语言无关模式。 | 许多开源项目仅支持少量语言,或需要为不同语言配置不同模型。 |
适合谁用
- 需要在应用程序或服务中集成文本转语音功能,且要求数据本地处理、保护用户隐私的开发者
- 需要在离线或网络不稳定环境下(如车载系统、物联网设备)使用语音合成功能的用户
- 需要快速将多语言文本内容转换为音频文件的内容创作者或教育工作者
下载与版本
当前最新版本为 v2.0.0,发布于 2026-01-06。支持 Windows、macOS、Linux。
⚠️ 注意:本项目仅提供源代码下载,不包含可直接运行的安装包(exe/dmg/apk 等。下载后需要自行编译构建才能使用,适合有一定开发经验的用户。如果你不熟悉编译流程,建议寻找同类开箱即用的替代方案。
注意事项
- 本工具仅供学习和研究使用,请遵守相关法律法规。
- 请尊重内容创作者版权,勿将下载内容用于商业或非法传播。
- 项目源码地址:https://github.com/supertone-inc/supertonic