微信扫码
添加专属顾问
我要投稿
MinerU:开源文档解析神器,一键将PDF/图片转为结构化数据,支持37种语言和多种输出格式,开发者必备工具! 核心内容: 1. MinerU的核心能力与全流程解析引擎 2. 高性能解析引擎与极简部署方案 3. 开源生态扩展与五分钟快速上手指南
MinerU是一款开源的工业级文档解析工具,致力于解决非结构化文档(如PDF、扫描图像)的智能化处理难题。它通过深度学习技术将原始文档精准转换为可编辑的Markdown、JSON或HTML格式,并完整保留文字、表格、数学公式、图片等多模态元素的结构与语义。
中/英/日/韩等主流语言全覆盖,特别优化东亚文字排版识别
学术论文(参考文献/章节层级)、法律文书(条款编号)、财务报表(跨页表格)均可精准还原
| 零安装Web版 | ||
| 命令行工具 | mineru -p report.pdf -o md | |
| Docker GPU加速 | docker run --gpus all mineru-sglang:latest |
# 自定义模型路径(例:加载本地OCR模型)
mineru --ocr_model_path ./custom_ppocrv5
--formula True)、表格还原(--table True)独立开关--source local 完全断网运行MarkdownJSONHTML# 基础环境配置
conda create -n mineru python=3.10
pip install "mineru[core]" # 安装核心包
# 启用SGLANG加速(需NVIDIA显卡)
mineru -p input.pdf -o outputs -b vlm-sglang-client -u http://localhost:30000
InternLM团队研发,技术论文发布于arXiv:2409.18839
2025 V2.0路线图:垂直文本支持(古文献/乐谱)、显存动态回收机制
GitHub万星项目,提供:
让数据流动,从MinerU开始! 🚀
53AI,企业落地大模型首选服务商
产品:场景落地咨询+大模型应用平台+行业解决方案
承诺:免费POC验证,效果达标后再合作。零风险落地应用大模型,已交付160+中大型企业
2026-03-22
Ollama绝赞适配World Monitor:无需API密钥的全球情报看板,金融地缘一手掌握!`
2026-03-22
重磅!VS Code 正式“改名”!绿色版 VS Code 更强!
2026-03-21
Hugging Face:AI 界的 GitHub 与开源协作的终极生态杠杆
2026-03-21
OpenMAIC课程生成很惊艳,但"像一堂课"不等于"是一堂有效的课"
2026-03-20
企业级 Agent 多智能体架构与选型指南 -- 来自1000+行业应用实践积累
2026-03-20
ollama v0.18.2 发布!OpenClaw 安装优化、Claude 加速、MLX 量化全面升级
2026-03-19
开源版Cowork——Eigent集成ERNIE 5.0,让AI Agent自动化高效工作
2026-03-17
打造 Claude Code 并行自主开发环境:Auto Claude + GLM 4.7
2026-01-27
2026-01-30
2026-01-12
2026-01-29
2026-01-27
2026-01-28
2026-01-21
2025-12-23
2026-01-06
2026-01-26
2026-03-17
2026-03-13
2026-03-02
2026-02-05
2026-01-28
2026-01-26
2026-01-21
2026-01-21