产品简介
VoiceFlow 是一款开源免费的本地语音处理工具。它通过Whisper模型在你的电脑上直接进行语音转文字,无需联网,保障数据隐私。特别适合需要高效记录会议、进行语音输入,同时不愿将音频上传云端的用户。
核心功能
- 音频完全本地处理,无网络传输,保障数据安全。
- 支持录制系统音频与麦克风音轨,并可自动生成会议摘要。
- 提供从Tiny到Large-v3的16+种Whisper模型,平衡速度与精度。
- 支持NVIDIA CUDA自动加速,无GPU时自动回退到CPU。
- 支持超过99种语言的自动识别与转写。
快速开始
- 从GitHub Releases页面下载对应平台的安装包(Windows用.exe,Linux用.AppImage)。
- 安装并启动程序,首次运行将引导你完成麦克风、计算设备、模型下载和热键设置。
- 在需要时,按住配置的全局热键开始语音输入,松开后文字会自动输入到光标处。
界面预览
与其他方案对比
| 对比项 | VoiceFlow | 同类方案 |
|---|---|---|
| 成本 | 完全免费,无订阅费。 | 主流云服务通常需要每月10-15美元订阅。 |
| 数据隐私 | 音频数据始终保存在本地内存中,处理后存储在本地。 | 音频数据需上传至第三方服务器处理。 |
| 离线使用 | 所有核心功能可完全离线运行。 | 依赖网络连接,无法离线工作。 |
适合谁用
- 需要高效记录会议内容并生成摘要的职场人士。
- 注重隐私安全,不愿使用云语音服务的用户。
- 在Linux系统下需要稳定语音输入解决方案的开发者。
下载与版本
当前最新版本为 v1.6.2,发布于 2026-06-11。支持 Windows、Linux。点击页面「下载软件」按钮即可下载打包好的版本,根据你的电脑/手机系统来选择对应的软件。
注意事项
- 本工具仅供学习和研究使用,请遵守相关法律法规。
- 请尊重内容创作者版权,勿将下载内容用于商业或非法传播。
- 项目源码地址:https://github.com/infiniV/VoiceFlow