产品简介
ten-framework TEN是实时多模态对话AI的开源框架,提供多种预构建代理示例(如语音助手、涂鸦板),支持macOS和Linux平台,帮助开发者快速构建和定制AI语音应用,简化开发流程。
核心功能
- 实时语音助手,支持RTC和WebSocket连接
- 涂鸦板代理,将语音或文本转换为手绘草图
- 实时说话人分离和标记
- 唇形同步头像,兼容多种厂商
- 集成SIP呼叫、转录和硬件设备支持
快速开始
- 安装Docker和Node.js,并获取Agora、OpenAI等API密钥。
- 克隆仓库,配置.env文件。
- 使用Docker Compose启动开发容器。
- 进入容器构建代理示例。
- 启动web服务器,通过本地界面访问和定制。
界面预览
与其他方案对比
| 对比项 | ten-framework | 同类方案 |
|---|---|---|
| 开源与社区支持 | 完全开源,有活跃社区和丰富代理示例 | 某些商业框架可能闭源或示例较少 |
| 实时多模态集成 | 支持语音、视觉等多种模态实时处理 | 可能专注于单一模态或延迟较高 |
适合谁用
- 需要开发实时语音助手的AI开发者
- 探索多模态对话技术的科研人员
- 集成语音功能到硬件设备的嵌入式工程师
- 创建交互式应用的产品经理
下载与版本
当前最新版本为 0.11.68,发布于 2026-07-15。支持 macOS、Linux。点击页面「下载软件」按钮即可下载打包好的版本,根据你的电脑/手机系统来选择对应的软件。
注意事项
- 本工具仅供学习和研究使用,请遵守相关法律法规。
- 请尊重内容创作者版权,勿将下载内容用于商业或非法传播。
- 项目源码地址:https://github.com/TEN-framework/ten-framework