产品简介
GodEar 是一款实时语音转文本和翻译工具,能捕获麦克风或系统音频,进行语音识别、翻译并朗读。支持多种引擎(如Vosk、Whisper)、离线翻译和说话人识别,适合需要跨语言实时交流、会议记录或内容翻译的用户,尤其注重隐私和离线使用。
核心功能
- 实时语音翻译与本地语音朗读(TTS)
- 智能说话人识别与颜色标记
- 支持Vosk、Whisper等多种识别引擎
- 离线翻译,无需网络连接
- 透明叠加层显示翻译,支持GUI设置
- 全局热键控制,适用于全屏场景
- 快速响应,优化至0.22秒延迟
- 原生系统音频捕获(Windows/macOS/Linux)
快速开始
- 访问GitHub仓库Releases页面,下载对应系统的压缩包(如speech-to-text-windows.zip)。
- 解压压缩包,运行可执行文件(speech-to-text),首次启动自动下载模型。
- 通过交互菜单或命令行(如python main.py en ru)设置语言、引擎并开始翻译。
界面预览
与其他方案对比
| 对比项 | GodEar | 同类方案 |
|---|---|---|
| 离线支持 | 支持完全离线翻译和识别,无需网络 | 许多工具依赖在线API,无法离线使用 |
| 系统音频捕获 | 原生支持Windows、macOS、Linux直接捕获系统音频 | 可能需要虚拟声卡或额外软件设置 |
| 实时性 | 优化静音检测,翻译延迟低至0.22秒 | 延迟可能较高,影响实时体验 |
| 多引擎选择 | 支持Vosk、Whisper等多种引擎和混合模式,灵活平衡速度与精度 | 通常只支持单一引擎,选择有限 |
适合谁用
- 需要实时翻译外语会议或视频内容的商务人士
- 为视频、播客添加多语言字幕的内容创作者
- 在跨语言交流中需要即时翻译的普通用户,如旅行者或学生
- 注重隐私,需要离线翻译功能的用户
下载与版本
当前最新版本为 v2.0.1,发布于 2026-03-05。支持 Windows、macOS、Linux。点击页面「下载软件」按钮即可下载打包好的版本,根据你的电脑/手机系统来选择对应的软件。
注意事项
- 本工具仅供学习和研究使用,请遵守相关法律法规。
- 请尊重内容创作者版权,勿将下载内容用于商业或非法传播。
- 项目源码地址:https://github.com/MakarenD/GodEar