产品简介
HunyuanCustom 是一个多模态定制视频生成框架,能根据文本、图像、音频或视频输入生成身份一致的视频,解决现有方法身份易失真、输入模态单一的问题,适合需要制作虚拟广告、虚拟试穿、说话头像等内容的创作者和开发者。

核心功能
- 多模态输入支持:文本、图像、音频、视频驱动
- 单主体和多主体视频定制生成
- 音频驱动定制视频生成
- 视频驱动定制视频生成
- 低显存支持,单GPU仅需8GB显存
快速开始
- 安装Python环境及依赖库
- 下载HunyuanCustom预训练模型
- 运行推理命令生成定制视频
界面预览


与其他方案对比
| 对比项 | HunyuanCustom | 同类方案 |
|---|---|---|
| 身份一致性(Face-Sim) | 得分0.627,领先其他方法 | VACE-1.3B得0.204,Skyreels得0.402,Pika得0.363 |
| 整体质量(DINO-Sim) | 得分0.593,最高 | Keling1.6得0.580,Skyreels得0.579,VACE-1.3B得0.569 |
适合谁用
- 需要制作虚拟广告的营销人员
- 需要虚拟试穿功能的电商开发者
- 需要生成说话头像的内容创作者
- 需要视频编辑替换对象的视频制作者
下载与版本
当前最新版本为 main,发布于 。支持 Windows、macOS、Linux。
⚠️ 注意:本项目仅提供源代码下载,不包含可直接运行的安装包(exe/dmg/apk 等。下载后需要自行编译构建才能使用,适合有一定开发经验的用户。如果你不熟悉编译流程,建议寻找同类开箱即用的替代方案。
注意事项
- 本工具仅供学习和研究使用,请遵守相关法律法规。
- 请尊重内容创作者版权,勿将下载内容用于商业或非法传播。
- 项目源码地址:https://github.com/Tencent-Hunyuan/HunyuanCustom