产品简介
AudioBookGenerator -v4 是一款 AI 驱动的有声书生成工具,支持导入 TXT、EPUB、PDF 文件,自动识别对话角色并分配声线,生成原生 48k 高音质音频。适合中文小说作者、有声书制作者和内容创作者,解决手动配音耗时、音质不自然的痛点。
核心功能
- 支持导入 TXT、EPUB、PDF 文本文件
- 自动识别对话角色并分配不同声线
- 零样本 TTS:仅需5秒音频样本生成目标人声
- 原生 48k 音质,消除金属声,音频更清晰自然
- 提供桌面 GUI 界面,支持一键生成全书
快速开始
- 安装 Conda 并运行启动脚本创建环境
- 上传 GPT 和 SoVITS 模型文件到预设管理
- 导入文本文件并设置多人朗读模式
- 点击一键生成所有按钮生成有声书
界面预览
与其他方案对比
| 对比项 | AudioBookGenerator | 同类方案 |
|---|---|---|
| 音频质量 | 原生 48k 音质,消除金属声,更自然清晰 | 可能使用低采样率,声音模糊或有不自然金属感 |
| 易用性 | 桌面 GUI 界面,零样本 TTS,操作简单 | 可能需要复杂配置或大量训练数据 |
适合谁用
- 需要将中文小说转为有声书的作者或爱好者
- 制作多角色有声书的内容创作者
- 希望自动化生成教材音频的教育工作者
下载与版本
当前最新版本为 main,发布于 。支持 Windows、macOS、Linux。
⚠️ 注意:本项目仅提供源代码下载,不包含可直接运行的安装包(exe/dmg/apk 等。下载后需要自行编译构建才能使用,适合有一定开发经验的用户。如果你不熟悉编译流程,建议寻找同类开箱即用的替代方案。
注意事项
- 本工具仅供学习和研究使用,请遵守相关法律法规。
- 请尊重内容创作者版权,勿将下载内容用于商业或非法传播。
- 项目源码地址:https://github.com/JiaruiHu0102/AudioBookGenerator