产品简介
ASRT_SpeechRecognition 是一个开源免费的深度学习中文语音识别系统,可将中文语音转换为拼音序列和汉字文本。适合开发者训练自定义模型、研究人员进行语音实验,以及企业部署语音API服务,支持多平台运行。

核心功能
- 基于深度卷积神经网络、LSTM和CTC的深度学习模型
- 支持模型训练、测试和实时推理
- 提供HTTP和GRPC协议的API服务器
- 多平台兼容(Linux用于训练,Windows用于推理)
- 开源免费,基于GPL v3.0许可
快速开始
- 使用Git克隆ASRT项目仓库到本地
- 下载并解压中文语音数据集到指定目录(如/data/speech_data)
- 安装Python依赖库(如TensorFlow、numpy等)
- 运行训练脚本(python3 train_speech_model.py)或启动API服务器(python3 asrserver_http.py)进行识别
界面预览

与其他方案对比
| 对比项 | 本工具 | 同类商业软件 | 在线服务 |
|---|---|---|---|
| 费用 | 开源免费 | 通常收费或含广告 | 可能有订阅或上传限制 |
| 隐私 | 本地运行,数据自持 | 依赖厂商政策 | 需上传数据到服务器 |
| 可定制性 | 源码开放,社区活跃 | 受限于官方功能 | 功能固定 |
适合谁用
- 需要训练自定义中文语音识别模型的开发者
- 进行语音识别技术研究的科研人员
- 希望部署语音识别API服务的企业用户
- 学习深度学习在语音识别领域应用的初学者
下载与版本
当前最新版本为 v1.3.0,发布于 2022-05-20。支持 多平台。点击页面「下载软件」按钮即可下载打包好的版本,根据你的电脑/手机系统来选择对应的软件。
注意事项
- 本工具仅供学习和研究使用,请遵守相关法律法规。
- 请尊重内容创作者版权,勿将下载内容用于商业或非法传播。
- 项目源码地址:https://github.com/nl8590687/ASRT_SpeechRecognition