产品简介
ComfyUI-Qwen3-TTS 本工具是ComfyUI的自定义节点套件,基于Qwen3-TTS模型,提供文本转语音功能。支持自定义声音、声音设计、声音克隆和模型微调,适合AI开发者和内容创作者快速实现个性化语音合成。

核心功能
- ComfyUI模型文件夹集成,保持模型有序
- 按需下载模型,只下载所需版本
- 支持自定义声音、声音设计和声音克隆
- 微调自定义语音模型,优化VRAM使用
- 多语言支持和音频比较评估
快速开始
- 将仓库克隆到ComfyUI/custom_nodes文件夹
- 使用pip安装依赖文件
- 在ComfyUI中加载模型并使用节点生成音频
界面预览
与其他方案对比
| 对比项 | ComfyUI-Qwen3-TTS | 同类方案 |
|---|---|---|
| 声音克隆支持 | 支持完整的声音克隆和模型微调流程 | 可能仅支持基础文本转语音或预设声音 |
适合谁用
- 需要文本转语音的AI开发者
- 想创建自定义声音或克隆声音的内容创作者
- 研究语音合成模型的研究人员
下载与版本
当前最新版本为 main,发布于 。支持 Windows、macOS、Linux。
⚠️ 注意:本项目仅提供源代码下载,不包含可直接运行的安装包(exe/dmg/apk 等。下载后需要自行编译构建才能使用,适合有一定开发经验的用户。如果你不熟悉编译流程,建议寻找同类开箱即用的替代方案。
注意事项
- 本工具仅供学习和研究使用,请遵守相关法律法规。
- 请尊重内容创作者版权,勿将下载内容用于商业或非法传播。
- 项目源码地址:https://github.com/DarioFT/ComfyUI-Qwen3-TTS