产品简介
intelligent-ocr 这款工具用于将扫描版PDF转换为可全文搜索的PDF,特别针对中文古籍和学术文献优化。它解决了扫描文档无法复制、搜索文字的痛点,适合学者、研究人员和图书馆员批量处理中文文献,支持本地运行保护隐私。

核心功能
- 扫描图像保留,添加隐藏文字层支持全文搜索和复制
- 内置10,000+异体字映射,优化繁体古籍识别
- 拖拽文件夹批量入队,处理500页以上大书不崩溃
- 断点续传,中断后重启从上次位置继续
- 完全本地运行,模型无需联网,文件不上传服务器
快速开始
- 下载安装包并安装对应平台版本。
- 启动工具,将PDF文件拖入窗口或点击选择文件。
- 点击「开始处理」按钮,等待完成后在输出目录获取带_ocr后缀的文件。
界面预览

与其他方案对比
| 对比项 | intelligent-ocr | 同类方案 |
|---|---|---|
| 中文古籍优化 | 内置异体字映射,专为繁体古籍设计,识别率更高 | 通用OCR工具可能不专门优化古籍,识别效果较差 |
| 隐私与本地处理 | 完全本地运行,文件不上传任何服务器,保护隐私 | 在线OCR服务需上传文件到云端,存在隐私风险 |
适合谁用
- 研究中文古籍的学者,需要将扫描版文献转为可搜索文本
- 处理学术论文的研究人员,需批量识别PDF中的文字
- 图书馆员进行图书数字化项目,转换扫描图书为可搜索PDF
下载与版本
当前最新版本为 v2.2.6,发布于 2026-02-26。支持 Windows、macOS。点击页面「下载软件」按钮即可下载打包好的版本,根据你的电脑/手机系统来选择对应的软件。
注意事项
- 本工具仅供学习和研究使用,请遵守相关法律法规。
- 请尊重内容创作者版权,勿将下载内容用于商业或非法传播。
- 项目源码地址:https://github.com/anon-research-tools/intelligent-ocr