微信扫码
添加专属顾问
我要投稿
开源神器OCRmyPDF,30.6k星项目帮你轻松将扫描PDF转为可搜索可编辑文档,大幅提升工作效率! 核心内容: 1. 一键转换扫描PDF为可搜索/可复制格式,保留原始布局 2. 支持100+语言识别、自动纠偏和智能压缩优化 3. 跨平台兼容性强,通过Docker实现快速部署
OCRmyPDF 是一款开源的 PDF 处理工具,通过添加 OCR 文本层,OCRmyPDF 能够将无法直接编辑的扫描 PDF 文件变为可以搜索和编辑的格式,同时保留原始布局和图像质量。支持 Windows、macOS、Linux 与 FreeBSD 平台,也可通过 Docker 镜像运行。
•项目地址:https://github.com/ocrmypdf/OCRmyPDF
•开发者:James R. Barlow(核心)及社区贡献者
•Stars / Forks:约 30.6k ⭐ / 2.1k 🍴
•License:Mozilla Public License 2.0(MPL‑2.0,核心)/文档为 CC‑BY‑SA 4.0
•技术栈:Python 3, Shell, Ghostscript, Tesseract, qpdf, pngquant, jbig2enc
•目标用户:对扫描文档进行 OCR 的个人用户、图书馆/档案数字化、法律文件归档等。▶ 安装步骤
✅方法 A:推荐(包管理器/Docker 快速安装)
✅ 方法 B:进阶用户(Python + pip 安装)
brew install ghostscript tesseract qpdf pngquant
或在 Debian/Ubuntu:
sudo apt update
sudo apt install ghostscript tesseract-ocr tesseract-ocr-eng qpdf pngquantpip install / upgrade ocrmypdf
sudo apt install tesseract-ocr-chi-sim
然后执行如下命令:
ocrmypdf -l eng+chi_sim input.pdf output.pdf
▶ 使用流程示例
# 单页测试
ocrmypdf input.pdf output.pdf
# 在原文件基础上进行 OCR(成功覆盖原文件)
ocrmypdf input.pdf input.pdf
# 添加识别语言(英文 + 简体中文)
ocrmypdf -l eng+chi_sim scanned.pdf searchable.pdf
# 自动纠偏并输出 PDF/A
ocrmypdf --rotate-pages --deskew --output-type pdfa input.pdf output.pdf
# 批量处理(示例替换当前目录中所有 PDF,需自行验证)
for f in *.pdf; do
ocrmypdf "$f" "ocr/$f"
done安装完成后,用 ocrmypdf --help 可查看所有命令选项及说明。
53AI,企业落地大模型首选服务商
产品:场景落地咨询+大模型应用平台+行业解决方案
承诺:免费POC验证,效果达标后再合作。零风险落地应用大模型,已交付160+中大型企业
2025-12-17
ollama v0.13.4 发布——全新模型与性能优化详解
2025-12-17
n8n 悄悄发布了 v2.1.
2025-12-16
阿里重磅开源 0.5B TTS + 0.8B ASR,支持跨语种音色克隆、说唱识别!
2025-12-15
智谱手机 Agent 开源一周,iOS 版就来了
2025-12-15
OpenEvals下一代AI模型评估标准
2025-12-15
AutoGLM:推倒那面墙
2025-12-15
狂揽162K Star!n8n 2.0强势来袭,这次改动有点狠。
2025-12-14
ollama v0.13.3 最新发布:新增模型与功能优化详细解读
2025-10-20
2025-11-19
2025-10-27
2025-10-27
2025-10-03
2025-09-29
2025-10-29
2025-11-17
2025-09-29
2025-11-07
2025-11-12
2025-11-10
2025-11-03
2025-10-29
2025-10-28
2025-10-13
2025-09-29
2025-09-17