产品简介
cog-MeiGenAI-InfiniteTalk 用于音频驱动视频配音,根据音频生成口型同步视频,支持无限长度、减少失真,适合视频编辑和内容创作者。

核心功能
- 稀疏帧视频配音:同步嘴唇、头部、身体和表情
- 无限长度生成:支持任意时长视频
- 高稳定性:减少手部/身体失真
- 高唇部精度:优于同类工具 MultiTalk
- 支持图像到视频生成:从静态图像创建说话视频
快速开始
- 创建 conda 环境并安装 PyTorch 和 xformers
- 安装 flash-attn 和其他依赖项
- 下载所需模型文件并运行推理脚本
界面预览

与其他方案对比
| 对比项 | cog-MeiGenAI-InfiniteTalk | 同类方案 |
|---|---|---|
| 唇部同步精度 | InfiniteTalk 实现更优的唇部同步 | MultiTalk 同步效果较差 |
| 稳定性 | 减少手部/身体失真 | MultiTalk 有更多失真 |
适合谁用
- 需要为视频配音并同步口型的视频编辑者
- 想从图像生成说话视频的内容创作者
- 研究音视频生成技术的开发者
下载与版本
当前最新版本为 main,发布于 。支持 Windows、macOS、Linux。
⚠️ 注意:本项目仅提供源代码下载,不包含可直接运行的安装包(exe/dmg/apk 等。下载后需要自行编译构建才能使用,适合有一定开发经验的用户。如果你不熟悉编译流程,建议寻找同类开箱即用的替代方案。
注意事项
- 本工具仅供学习和研究使用,请遵守相关法律法规。
- 请尊重内容创作者版权,勿将下载内容用于商业或非法传播。
- 项目源码地址:https://github.com/zsxkib/cog-MeiGenAI-InfiniteTalk