产品简介
STT 是一个开源、跨平台的深度学习工具包,专注于语音转文本。它提供高质量预训练模型和高效训练管道,使模型训练和部署更简单,适合研究和生产环境中的开发者使用。项目已停止积极维护,但模型资源仍可访问。
核心功能
- 高质量预训练模型
- 多GPU支持的高效训练管道
- 流式推理
- 多个可能转录及置信度
- 实时推理
- 小脚印声学模型
- 多编程语言绑定
快速开始
- 下载程序:点击页面上的「下载软件」按钮获取。
- 运行程序:解压或安装后运行主程序。
- 开始使用:打开 STT,按界面提示操作。
界面预览
与其他方案对比
| 对比项 | STT | 同类方案 |
|---|---|---|
| 维护状态 | 项目已停止积极维护,但模型仍可用 | 如Whisper等新模型持续维护 |
适合谁用
- 进行语音识别研究的研究人员
- 开发语音转文本应用的工程师
- 生产环境中部署STT模型的团队
下载与版本
当前最新版本为 v1.4.0,发布于 2022-09-03。支持 Windows、macOS、Linux。点击页面「下载软件」按钮即可下载打包好的版本,根据你的电脑/手机系统来选择对应的软件。
注意事项
- 本工具仅供学习和研究使用,请遵守相关法律法规。
- 请尊重内容创作者版权,勿将下载内容用于商业或非法传播。
- 项目源码地址:https://github.com/coqui-ai/STT