MinerU 是一款文档解析工具,可将 PDF、图片以及 DOCX、PPTX、XLSX 转化为机器可读格式(如 Markdown、JSON),便于后续检索、抽取与二次处理。

主要功能
- 支持
PDF、图片与DOCX、PPTX、XLSX输入 - 删除页眉、页脚、脚注、页码等元素,确保语义连贯
- 输出符合人类阅读顺序的文本,适用于单栏、多栏及复杂排版
- 保留原文档的结构,包括标题、段落、列表等
- 提取图像、图片描述、表格、表格标题及脚注
- 自动识别并转换文档中的公式为LaTeX格式
- 自动识别并转换文档中的表格为HTML格式
- 自动检测扫描版PDF和乱码PDF,并启用OCR功能
- OCR支持109种语言的检测与识别
- 支持多种输出格式,如多模态与NLP的Markdown、按阅读顺序排序的JSON、含有丰富信息的中间格式等
- 支持多种可视化结果,包括layout可视化、span可视化等,便于高效确认输出效果与质检
- 内置命令行、FastAPI、Gradio WebUI,支持本地编排和多服务部署
- 支持纯CPU环境运行,并支持 GPU/MPS加速,以及十余款国产算力平台的推理加速
- 兼容Windows、Linux和Mac平台
核心解析能力
- 原生支持
DOCX、PPTX、XLSX解析 - 公式 → LaTeX · 表格 → HTML,精准还原复杂版面
- 支持扫描件、手写体、多栏布局、跨页表格合并
- 输出符合人类阅读顺序,自动去除页眉页脚
- VLM + OCR 双引擎,支持 109 种语言识别

下载地址
https://pan.quark.cn/s/9b31f0e82f83
https://www.guangyapan.com/s/1935701382754729991_alXmYMu9gxLNGFZD
https://github.com/opendatalab/mineru
1本站电脑及安卓软件内的所有广告和提示均为作者自留,非本站信息,注意鉴别;
2若作商业用途,请联系原作者授权,若本站侵犯了您的权益请联系站长进行删除处理;
3原创文章,作者:bxwl,如若转载,请注明出处:https://www.61ku.com/1387.html