产品推荐 2026-07-23

FunASR:开源工具包本地部署的工业级语音识别工具包

一个工业级的开源语音识别工具包,用于构建端到端的语音处理应用。

开源软件跨平台工具

产品简介

FunASR 是一个功能全面的开源语音识别工具包。它集成了语音识别、语音活动检测、标点恢复、说话人分离等多种能力,支持多种语言和方言。它解决了云端API延迟高、成本贵、无法定制的问题,特别适合需要在本地或边缘设备上部署高精度、可定制化语音服务的开发者与研究人员。

FunASR 主界面

核心功能

  • 多语言语音识别(如中英日及31种语言)
  • 集成说话人分离与情绪识别功能
  • 支持低延迟流式识别与边缘设备部署
  • 提供兼容OpenAI的API服务与AI代理集成
  • 拥有多种预训练模型可选,性能超越同类方案

快速开始

  1. 第一步:通过 pip install funasr 安装工具包。
  2. 第二步:使用 AutoModel 加载如 ‘Fun-ASR-Nano’ 或 ‘SenseVoiceSmall’ 等预训练模型。
  3. 第三步:调用 model.generate(input=‘音频文件’) 方法进行语音识别。
  4. 第四步:使用 funasr-server 命令启动兼容 OpenAI 的 API 服务器。

界面预览

FunASR 界面截图

与其他方案对比

对比项FunASR同类方案
识别速度支持340倍实时率的加速识别Whisper最高速度约13倍实时
说话人识别内置VAD与CAM++管道,原生支持Whisper需额外依赖库
多语言与方言支持提供针对中文方言、口音及31种语言的专用模型Whisper支持57种语言但无方言细分
部署与成本支持本地、边缘自托管,开源免费云API通常按使用量收费,且无法本地化

适合谁用

  • 需要将语音能力集成到自有应用中的开发者
  • 进行多语言或方言语音识别研究的科研人员
  • 寻求在本地或边缘设备部署低延迟语音服务的企业

下载与版本

当前最新版本为 runtime-llamacpp-v0.1.8,发布于 2026-07-22。支持 macOS、Linux。点击页面「下载软件」按钮即可下载打包好的版本,根据你的电脑/手机系统来选择对应的软件。

注意事项

  • 本工具仅供学习和研究使用,请遵守相关法律法规。
  • 请尊重内容创作者版权,勿将下载内容用于商业或非法传播。
  • 项目源码地址:https://github.com/modelscope/FunASR