微信扫码
添加专属顾问
我要投稿
开源神器OCRmyPDF,30.6k星项目帮你轻松将扫描PDF转为可搜索可编辑文档,大幅提升工作效率! 核心内容: 1. 一键转换扫描PDF为可搜索/可复制格式,保留原始布局 2. 支持100+语言识别、自动纠偏和智能压缩优化 3. 跨平台兼容性强,通过Docker实现快速部署
OCRmyPDF 是一款开源的 PDF 处理工具,通过添加 OCR 文本层,OCRmyPDF 能够将无法直接编辑的扫描 PDF 文件变为可以搜索和编辑的格式,同时保留原始布局和图像质量。支持 Windows、macOS、Linux 与 FreeBSD 平台,也可通过 Docker 镜像运行。
•项目地址:https://github.com/ocrmypdf/OCRmyPDF
•开发者:James R. Barlow(核心)及社区贡献者
•Stars / Forks:约 30.6k ⭐ / 2.1k 🍴
•License:Mozilla Public License 2.0(MPL‑2.0,核心)/文档为 CC‑BY‑SA 4.0
•技术栈:Python 3, Shell, Ghostscript, Tesseract, qpdf, pngquant, jbig2enc
•目标用户:对扫描文档进行 OCR 的个人用户、图书馆/档案数字化、法律文件归档等。▶ 安装步骤
✅方法 A:推荐(包管理器/Docker 快速安装)
✅ 方法 B:进阶用户(Python + pip 安装)
brew install ghostscript tesseract qpdf pngquant
或在 Debian/Ubuntu:
sudo apt update
sudo apt install ghostscript tesseract-ocr tesseract-ocr-eng qpdf pngquantpip install / upgrade ocrmypdf
sudo apt install tesseract-ocr-chi-sim
然后执行如下命令:
ocrmypdf -l eng+chi_sim input.pdf output.pdf
▶ 使用流程示例
# 单页测试
ocrmypdf input.pdf output.pdf
# 在原文件基础上进行 OCR(成功覆盖原文件)
ocrmypdf input.pdf input.pdf
# 添加识别语言(英文 + 简体中文)
ocrmypdf -l eng+chi_sim scanned.pdf searchable.pdf
# 自动纠偏并输出 PDF/A
ocrmypdf --rotate-pages --deskew --output-type pdfa input.pdf output.pdf
# 批量处理(示例替换当前目录中所有 PDF,需自行验证)
for f in *.pdf; do
ocrmypdf "$f" "ocr/$f"
done安装完成后,用 ocrmypdf --help 可查看所有命令选项及说明。
53AI,企业落地大模型首选服务商
产品:场景落地咨询+大模型应用平台+行业解决方案
承诺:免费POC验证,效果达标后再合作。零风险落地应用大模型,已交付160+中大型企业
2026-02-03
Claude Code——智能路由与切换工具
2026-02-03
作为投资方,我们试了试Kimi K2.5
2026-02-03
暴涨11.7k Star!复刻Manus上下文工程的开源Skills,Claude code等多个平台即插即用
2026-02-03
ollama v0.15.4 更新:OpenClaw全面上线,优化集成流程与工具解析能力大升级!
2026-02-03
阶跃星辰 Step 3.5 Flash 上线!更快更强更稳的 Agent 大脑,开源!
2026-02-02
一分钟部署OpenClaw+QQ,国内最爽的一键启动!
2026-02-02
这家字节系AI初创,推出首个开源Agent Skills Builder!对话Refly.AI李锦威:大多数Agent都停留在专业用户层面,没有做到真正的普惠
2026-02-02
OCR又出宠OpenDoc,速度超MinerU6倍
2025-11-19
2026-01-27
2025-12-22
2025-12-10
2025-11-17
2026-01-12
2025-11-07
2025-12-23
2026-01-29
2026-01-06
2026-01-28
2026-01-26
2026-01-21
2026-01-21
2026-01-20
2026-01-16
2026-01-02
2025-12-24