MinerU是一款免费开源的PDF转Markdown格式软件,从MinerU软件刚开始发布我就和大家分享了,到现在很多人在用这款软件,而且MinerU功能也越来越强大,前天MinerU又将版本更新到了0.10.0版,而且更新了比较重要的功能。最近这一个月MinerU更新了4次,很多人都让我更新一下整合包,今天我做了最新版的MinerU一键启动整合包,大家有用得到PDF转Markdown场景的话,可以下载MinerU试一试。

MinerU介绍
一款用于将PDF转换为Markdown和JSON的高质量工具。开源数据导出工具,将PDF转换成Markdown和JSON格式。
MinerU更新日志
- 2024/11/22 0.10.0 发布。引入混合 OCR 文本提取功能,
- 显著提升密集公式、不规则跨区域、文本以图片表示等复杂文本分布场景的解析性能。
- 兼具文本模式下精准内容提取、速度更快的双重优势,以及OCR模式下更精准的跨度/行区域识别。
- 2024/11/15 发布 0.9.3 版本,集成RapidTable进行表格识别,单表解析速度提升10倍以上,准确率更高,GPU内存占用更低。
- 2024/11/06 0.9.2 发布。集成StructTable-InternVL2-1B模型,实现表格识别功能。
- 2024/10/31 0.9.0 发布。这是一个重要的新版本,进行了广泛的代码重构,解决了许多问题,提高了性能,降低了硬件要求并增强了可用性:
- 重构sorting模块代码,使用layoutreader进行读取顺序排序,保证在各种布局下都有较高的准确率。
- 重构段落拼接模块,在跨列、跨页、跨图、跨表的场景下达到良好效果。
- 重构列表及目录识别功能,大幅提升列表块和目录块的准确率以及对应文本段落的解析。
- 重构图表、表格及说明性文字的匹配逻辑,大幅提升图表图注及脚注匹配准确率,说明性文字的丢失率接近于零。
- 增加OCR多语言支持,支持84种语言的检测和识别。支持语言列表请参见OCR语言支持列表。
- 增加内存回收逻辑等内存优化措施,大幅降低内存占用,除表格加速(布局/公式/OCR)外所有加速特性开启内存需求由16GB降低至8GB,所有加速特性开启内存需求由24GB降低至10GB。
- 优化配置文件功能开关,增加独立公式检测开关,在不需要公式检测的情况下,大幅提升速度和解析结果。
- 集成PDF-Extract-Kit 1.0:
- 增加了自主研发的模型,在保持解析效果相似的前提下,处理速度比原方案提高10倍以上,并可通过配置文件
doclayout_yolo
自由切换。layoutlmv3
- 公式解析升级为
unimernet 0.2.1
,提高公式解析准确率的同时大幅降低内存占用。 - 由于 的仓库变更
PDF-Extract-Kit 1.0
,您需要重新下载模型。详细步骤请参阅如何下载模型。
- 增加了自主研发的模型,在保持解析效果相似的前提下,处理速度比原方案提高10倍以上,并可通过配置文件
MinerU主要特点
- 删除页眉、页脚、脚注、页码等,以确保语义一致性。
- 以人类可读的顺序输出文本,适用于单列、多列和复杂布局。
- 保留原始文档的结构,包括标题、段落、列表等。
- 提取图像、图像描述、表格、表格标题和脚注。
- 自动识别文档中的公式并转换为 LaTeX 格式。
- 自动识别文档中的表格并转换为HTML格式。
- 自动检测扫描的 PDF 和乱码 PDF 并启用 OCR 功能。
- OCR支持84种语言的检测和识别。
- 支持多种输出格式,如多模式和 NLP Markdown、按阅读顺序排序的 JSON 以及丰富的中间格式。
- 支持多种可视化结果,包括布局可视化、跨度可视化,可有效确认输出质量。
- 支持 CPU 和 GPU 环境。
- 兼容 Windows、Linux 和 Mac 平台。

MinerU一键启动整合包使用说明:
首先到我网盘里将主程序压缩包MinerU_20241124.7z下载到电脑上解压,然后将模型文件PDF-Extract-Kit-1.0.7z下载到MinerU_20241124文件夹内并解压,这个最新版本和以前分享的老版本的模型是不兼容的,所以你得下载这个最新版的模型才行。
如果你以前用过MinerU这个软件的话,防止你以前用的版本和最新版本不兼容,先删除C:\Users\你的电脑用户名\magic-pdf.json文件。注意你的电脑用户名不能是中文及特殊字符,最好使用英文字符命名,否则程序会报错。
打开MinerU项目文件夹找到【0启动软件.exe】,双击即可启动应用。
待处理文件一栏里可以是单个PDF文件名,也可以是包含多个PDF文件的文件夹名,可以直接拖动待处理文件或文件夹到程序窗口会自动填入路径输入框。
处理方法有auto,ocr,txt三种方式,ocr:使用ocr技术从pdf中提取信息。txt:仅适用于基于文本的pdf,效果优于ocr。auto:自动从ocr和txt中选择最佳方法解析pdf。如果未指定方法,则默认使用auto。
表格识别模型默认为rapid_table,你也可以改为”tablemaster” 或 “struct_eqtable”
表格识别功能默认是关闭的,开启这个功能的话会比较吃电脑配置,如果你PDF中没有表格的话,那么就不要开启这个功能了。
公式识别功能默认是开启的,如果你的PDF中没有公式的话,那么你可以关闭这个功能,以节省计算量。
最终识别结果在你选择的保存位置文件夹中,程序自动为每个文件夹以文件名命名,其中包含了md,json格式文件,还有提取到的图片等内容,具体可自行查看。
注意事项
软件程序运行路径中请不要有非英文字符及空格
如果PDF文档内容比较复杂,如有很多表格和公式或是PDF文件比较大,处理时间就会比较长,建议将PDF文档用分割工具分割成多个体积较小文档进行处理,每个文档处理时间请在400秒内完成。
使用软件前请先将英伟达显卡驱动更新到最新版本,否则软件会报错显存不足的错误
本整合包软件为Windows电脑版软件,需要有英伟达独立显卡4G或是更高显存,不支持手机和MAC系统。
PDF转Markdown软件MinerU一键启动包v0.10.0下载链接
相关推荐
PDF转Markdown软件MinerU 1.1.0版整合包使用说明视频教程
PDF转Markdown软件MinerU最新1.2.0版一键启动整合包下载
PDF/EPUB转Markdown/HTML软件Marker v1.6.1 2025-03-21版
PDF转Markdown软件zerox整合包,利用在线大语言模型识别转换PDF内容
批量PDF文档转MD格式软件marker整合包下载,PDF文件转Markdown格式文件工具
人脸图片处理换脸软件facefusion整合包下载,改变年龄重建表情工具
本地文档聊天对话软件localGPT整合包下载,大语音模型文档内容分析总结
免费文字转语音软件EmotiVoice整合包下载,TTS情感语音合成工具
最近更新

AI描述万物软件describe-anything整合包,精准描述图片视频中指定区域内容
本次和大家分享一个英伟达联合其他大学开发的一款应用describe-anything,该应用可以通过AI识别分析并详细描述图片视频中指定区域物体内容,我基于最新版制作了免安装一键启动整合包。 describe-anything介绍 Desc...

高效可控歌曲生成器ACE-Step一键启动整合包,音乐人的歌曲创作利器
又一款AI歌曲创作利器:ACE-Step,ACE-Step是刚发布不久的AI自动谱曲AI自动演唱软件,软件在歌曲生成速度、音乐连贯性和可控性上相对同类软件有了较大提升。ACE-Step在3小时前刚发布了新版本,我基于当前最新版本制作了免安装...

超逼真对话型文字转语音软件Dia-1.6B免安装一键启动整合包下载
本次分享一个刚出的超逼真对话型文字转语音软件Dia-1.6B,这个TTS软件不像传统的文字转语音那样,Dia可以生成对话音频,还可以生成非语言音效,如笑声,咳嗽,清嗓子等,还支持声音克隆。我基于当前Dia最新版本制作了免安装一键启动整合包。...

高精度2D图片转3D网格模型软件Stable3DGen整合包下载
本次和大家分享另一个非常牛叉的图片转3D模型软件Stable3DGen,从官方演示对比来看,效果要好于我之前分享的腾讯混元3D和TRELLIS,精度更高更细腻。基于当前最新版本我制作了一键启动整合包。 Stable3DGen介绍 随着从二维...

2D照片转3D视频软件stable-virtual-camera免安装一键启动整合包下载
本次和大家分享一个好玩实用的2D图片转3D视频软件stable-virtual-camera,支持多种相机模式,生成的3D视频效果丰富多样,适合多种使用场景,我基于当前最新版本制作了免安装一键启动整合包。 stable-virtual-ca...

AI歌曲创作软件DiffRhythm一键启动包,自定义风格AI谱曲演唱
DiffRhythm是首个基于扩散技术的开源音乐生成模型,能够创作完整的歌曲,包括AI谱曲,AI演唱。基于当前最新V1.2版本我制作了免安装一键启动整合包。 DiffRhythm介绍 Di♪♪Rhythm:速度惊人、简单至极、具有潜在扩散的...

虚拟试衣产品设计多图合成软件UNO一键启动整合包,人物转动漫工具
UNO是字节跳动开发的一款多主体图像生成软件,解决了角色或物体一致性的问题,可用于漫画、虚拟试衣等场景。我基于当前最新版本制作了免安装一键启动整合包。 UNO介绍 UNO是一款基于扩散模型的AI图像生成工具,核心目标是解决AI生成图像时难以...

临时邮箱,一次性匿名gmail.com邮箱
有时候网站需要测试一些功能,比如注册登录等,需要用到邮箱,但是自己的邮箱有限,不能更多的测试效果,这时候就需要一些不同后缀的一次性邮箱,网上有很多这样的一次性匿名邮箱,后缀很多,非常适合测试使用,下面分享几个比较好用的临时邮箱。 Gmail...

免费AI视频生成软件FramePack整合包下载,本地离线AI图片转视频工具
前段时间阿里开源了一个AI视频生成工具WAN2.1,可以实现文本转视频和图片转视频,虽说很强大,但是测试之后感觉软件对电脑配置要求太高了,感觉应该大部分用户都用不了,而且只支持720P视频,清晰度有些低,所以没和大家分享。前些天又出了一个更...

PDF OCR图片文字内容识别软件OCRmyPDF下载,免费PDF扫描内容转可搜索可复制工具
本次和大家分享一个非常热门强大的PDF文件内容OCR识别软件OCRmyPDF,这个软件可以将PDF内不可搜索的图片和文字识别转换为可复制可搜索的文本,并对PDF文件进行优化。 OCRmyPDF介绍 OCRmyPDF 为扫描的 PDF 文件添...