产品简介
Bernini 是一个结合AI语义规划和渲染的视频处理框架,支持文本、图像、视频间转换,适合需要高效生成和编辑视频的创作者与开发者。

核心功能
- 统一框架整合MLLM语义规划器和DiT渲染器
- 支持多种任务如文本到视频、视频到视频等
- 通过语义规划优化复杂视频指令
- 在视频编辑中表现媲美商业模型
- 提供提示增强功能提升生成质量
快速开始
- 克隆Bernini仓库并进入目录
- 使用pip安装requirements.txt中的依赖
- 安装必需的Open-VeOmni库
- 参考文档下载模型权重并运行推理
界面预览

与其他方案对比
| 对比项 | Bernini | 同类方案 |
|---|---|---|
| 视频编辑性能 | 在自建平台人类评估中表现接近顶级商业模型 | 商业模型通常闭源且可能更昂贵 |
| 模型可用性 | 提供多种开源模型权重和训练代码 | 商业模型通常不公开权重和代码 |
适合谁用
- 需要AI视频生成和编辑的内容创作者
- 研究视频扩散模型的AI研究人员
- 开发视频处理工具的软件开发者
下载与版本
当前最新版本为 main,发布于 。支持 Windows、macOS、Linux。
⚠️ 注意:本项目仅提供源代码下载,不包含可直接运行的安装包(exe/dmg/apk 等。下载后需要自行编译构建才能使用,适合有一定开发经验的用户。如果你不熟悉编译流程,建议寻找同类开箱即用的替代方案。
注意事项
- 本工具仅供学习和研究使用,请遵守相关法律法规。
- 请尊重内容创作者版权,勿将下载内容用于商业或非法传播。
- 项目源码地址:https://github.com/bytedance/Bernini