产品简介
SwiftLM 是专为 Apple Silicon 设计的原生 Swift 大模型推理服务器,提供 OpenAI 兼容 API,支持 SSD 流处理和 TurboQuant 压缩技术,能高效运行超大模型(如 100B+ MoE),解决本地推理慢、内存占用高的痛点,适合开发者在 Mac 上快速部署 AI 应用。

核心功能
- 原生 Swift 推理引擎,无 Python 依赖
- 兼容 OpenAI API,易于集成
- SSD 流处理支持超大模型推理
- TurboQuant KV 缓存压缩减少内存使用
- 支持 macOS 和 iOS 应用部署
快速开始
- 从 GitHub Releases 页面下载最新版本的预构建二进制文件
- 解压后运行 ./SwiftLM --model <模型名> --port <端口> 命令启动服务器
- 或克隆仓库并运行 ./build.sh 从源代码构建后启动
界面预览

与其他方案对比
| 对比项 | 本工具 | 同类商业软件 | 在线服务 |
|---|---|---|---|
| 费用 | 开源免费 | 通常收费或含广告 | 可能有订阅或上传限制 |
| 隐私 | 本地运行,数据自持 | 依赖厂商政策 | 需上传数据到服务器 |
| 可定制性 | 源码开放,社区活跃 | 受限于官方功能 | 功能固定 |
适合谁用
- 需要在 Apple Silicon Mac 上本地运行大模型的 AI 开发者
- 希望使用 OpenAI 兼容接口进行快速推理的工程师
- 需要处理长上下文(如 100K tokens)的研究人员
下载与版本
当前最新版本为 b648,发布于 2026-05-08。支持 macOS。点击页面「下载软件」按钮即可下载打包好的版本,根据你的电脑/手机系统来选择对应的软件。
注意事项
- 本工具仅供学习和研究使用,请遵守相关法律法规。
- 请尊重内容创作者版权,勿将下载内容用于商业或非法传播。
- 项目源码地址:https://github.com/SharpAI/SwiftLM