产品简介
VideoGen-Eval 这是一个基于智能体的视频生成评估系统,用于系统性测试和对比市面上多种主流AI视频生成模型(如Sora、可灵、Luma等)的生成质量。它解决了现有评估指标与人类偏好不符、缺乏全面对比基准的痛点,适合AI视频生成领域的研究人员、开发者和内容创作者。

核心功能
- 基于智能体的动态、可进化评估系统
- 收录10+主流闭源及开源视频生成模型的超过8000个案例
- 提供700个关键提示词用于生成与评估
- 通过pypi包VGenEval一键获取任意案例的输入提示词
- 提供所有生成视频的公开下载与在线浏览
快速开始
- 第一步:通过pip安装VGenEval包 (`pip install VGenEval`)。
- 第二步:使用代码 `from VGenEval import load_prompt` 加载模块,并调用 `load_prompt.get_prompts([id_list], 'model_name')` 获取指定模型和ID的输入提示词。
- 第三步:根据官网提供的ID,从Google Drive或百度网盘下载对应的生成视频结果,或在官网直接浏览对比。
界面预览

与其他方案对比
| 对比项 | VideoGen-Eval | 同类方案 |
|---|---|---|
| 评估方式 | 基于智能体的动态、灵活、可进化评估系统,能随模型发展而迭代。 | 传统评估依赖固定的静态指标,往往与人类主观感受存在偏差。 |
| 对比范围 | 提供覆盖10多个主流闭源和开源模型的统一评测基准,包含超过8000个案例。 | 通常只在少量模型或有限提示词下进行对比,缺乏全面性。 |
适合谁用
- 需要评估和对比不同视频生成模型效果的AI研究者与开发者
- 为项目选型或优化需要系统测试视频生成工具的技术负责人
- 希望了解最前沿AI视频生成能力现状的内容创作者
下载与版本
当前最新版本为 main,发布于 。支持 Windows、macOS、Linux。
⚠️ 注意:本项目仅提供源代码下载,不包含可直接运行的安装包(exe/dmg/apk 等。下载后需要自行编译构建才能使用,适合有一定开发经验的用户。如果你不熟悉编译流程,建议寻找同类开箱即用的替代方案。
注意事项
- 本工具仅供学习和研究使用,请遵守相关法律法规。
- 请尊重内容创作者版权,勿将下载内容用于商业或非法传播。
- 项目源码地址:https://github.com/AILab-CVC/VideoGen-Eval