产品简介
AI-Vision-Chat Vision Chat 是一个原生桌面客户端,支持 Windows、macOS 和 Linux,用于与大型语言模型交流图像内容。它集成了多个视觉语言模型,并可通过 Replicate.com 进行云端或本地 Docker 运行。适合需要分析图像或进行AI对话的用户。
核心功能
- 支持多个视觉语言模型(如 LLaVA-13b、fuyu-8b 等)
- 跨平台支持(Windows、macOS、Linux)
- 包含 API X-Ray 标签,便于查看交互过程
- 集成 Replicate.com,支持云端或本地 Docker 运行模型
- 原生桌面客户端界面
快速开始
- 注册 Replicate.com 获取 API key
- 使用 Docker 命令 'docker run -d -p 5000:5000 --gpus=all r8.im/yorickvp/llava-13b@sha256:6bc1c7bb0d2a34e413301fee8f7cc728d2d4e75bfab186aa995f63292bda92fc' 启动本地模型服务
- 通过 curl 命令或桌面客户端发送图像和提示进行对话
界面预览
与其他方案对比
| 对比项 | AI-Vision-Chat | 同类方案 |
|---|---|---|
| 模型支持 | 集成多种视觉语言模型如LLaVA-13b | 可能仅支持单一模型或有限选项 |
| 部署灵活性 | 支持云端API和本地Docker运行 | 通常仅云端或需要复杂本地配置 |
适合谁用
- 需要快速分析图像内容的设计师或艺术家
- 进行图像相关研究的学生或研究人员
- 对AI视觉模型感兴趣的开发者或技术爱好者
下载与版本
当前最新版本为 v1.1,发布于 2023-10-20。支持 多平台。点击页面「下载软件」按钮即可下载打包好的版本,根据你的电脑/手机系统来选择对应的软件。
注意事项
- 本工具仅供学习和研究使用,请遵守相关法律法规。
- 请尊重内容创作者版权,勿将下载内容用于商业或非法传播。
- 项目源码地址:https://github.com/FMXExpress/AI-Vision-Chat