今天和大家分享一个PDF文件转Markdown格式软件MinerU,这个软件可以同时将一个pdf或是多个pdf文件批量转换成md格式和JSON格式文件,本软件为免费开源软件,原项目地址:https://github.com/opendatalab/MinerU,原应用是通过终端运行命令执行相应功能的,我做了个UI界面,如图所示:

主要特点
- 删除页眉、页脚、脚注和页码等元素,同时保持语义连续性
- 从多列文档中以人类可读的顺序输出文本
- 保留文档的原始结构,包括标题、段落和列表
- 提取图像、图像说明、表格和表格说明
- 自动识别文档中的公式并将其转换为 LaTeX
- 自动识别文档中的表格并将其转换为 LaTeX
- 自动检测并启用损坏 PDF 的 OCR
- 支持 CPU 和 GPU 环境
- 支持 Windows、Linux 和 Mac 平台(我打包版本只支持Windows)
软件操作也很简单,先选择PDF文件或是pdf所在文件夹,注意如果是选择文件夹的话路径末尾不能有”\”,再选择保存位置,处理方法默认auto,另外还有ocr和txt,如果正在处理包含大量公式的 PDF,强烈建议启用 OCR 功能。
如果有高配显卡的话,可以选择GPU模式速度更快,没有的话可以选择CPU模式,点击开始处理按钮,处理完成后在输出文件夹内就可以看到输出结果md和JSON格式文件
本整合包只支持Windows电脑版,不支持手机和mac,有需要的可以自己去测试。
2024-09-16更新
MinerU在9月12日发布了0.8.1版本,同时在14日发布了新的模型文件,所以我重新制作了最新版的一键启动整合包
新的整合包UI界面增加了表格操作的相关选项,如果你的PDF中有大量表格的话,可以通过开启表格识别功能增加导出效果
软件默认处理最大时间为400秒,也就是说如果超过400秒,你的转换任务还没有完成,那么软件可能会报错。所以请根据你的电脑配置合理安排每次识别PDF的数量
2024-11-24更新v0.10.0
我更新了最新0.10.0版本整合包,详情查看《最新版PDF转Markdown格式软件MinerU一键启动整合包v0.10.0下载》
PDF格式转Markdown软件MinerU一键启动整合包下载:
相关推荐
PDF转Markdown软件MinerU 1.1.0版整合包使用说明视频教程
PDF转Markdown软件MinerU最新1.2.0版一键启动整合包下载
PDF/EPUB转Markdown/HTML软件Marker v1.6.1 2025-03-21版
PDF转Markdown软件zerox整合包,利用在线大语言模型识别转换PDF内容
免费Windows电脑数据恢复软件Windows File Recovery,官方版UI版
最新版PDF转Markdown格式软件MinerU一键启动整合包v0.10.0下载
批量PDF文档转MD格式软件marker整合包下载,PDF文件转Markdown格式文件工具
图片视频指定区域内容删除替换软件Inpaint-Anything整合包下载
最近更新

高效可控歌曲生成器ACE-Step一键启动整合包,音乐人的歌曲创作利器
又一款AI歌曲创作利器:ACE-Step,ACE-Step是刚发布不久的AI自动谱曲AI自动演唱软件,软件在歌曲生成速度、音乐连贯性和可控性上相对同类软件有了较大提升。ACE-Step在3小时前刚发布了新版本,我基于当前最新版本制作了免安装...

超逼真对话型文字转语音软件Dia-1.6B免安装一键启动整合包下载
本次分享一个刚出的超逼真对话型文字转语音软件Dia-1.6B,这个TTS软件不像传统的文字转语音那样,Dia可以生成对话音频,还可以生成非语言音效,如笑声,咳嗽,清嗓子等,还支持声音克隆。我基于当前Dia最新版本制作了免安装一键启动整合包。...

高精度2D图片转3D网格模型软件Stable3DGen整合包下载
本次和大家分享另一个非常牛叉的图片转3D模型软件Stable3DGen,从官方演示对比来看,效果要好于我之前分享的腾讯混元3D和TRELLIS,精度更高更细腻。基于当前最新版本我制作了一键启动整合包。 Stable3DGen介绍 随着从二维...

2D照片转3D视频软件stable-virtual-camera免安装一键启动整合包下载
本次和大家分享一个好玩实用的2D图片转3D视频软件stable-virtual-camera,支持多种相机模式,生成的3D视频效果丰富多样,适合多种使用场景,我基于当前最新版本制作了免安装一键启动整合包。 stable-virtual-ca...

AI歌曲创作软件DiffRhythm一键启动包,自定义风格AI谱曲演唱
DiffRhythm是首个基于扩散技术的开源音乐生成模型,能够创作完整的歌曲,包括AI谱曲,AI演唱。基于当前最新V1.2版本我制作了免安装一键启动整合包。 DiffRhythm介绍 Di♪♪Rhythm:速度惊人、简单至极、具有潜在扩散的...

虚拟试衣产品设计多图合成软件UNO一键启动整合包,人物转动漫工具
UNO是字节跳动开发的一款多主体图像生成软件,解决了角色或物体一致性的问题,可用于漫画、虚拟试衣等场景。我基于当前最新版本制作了免安装一键启动整合包。 UNO介绍 UNO是一款基于扩散模型的AI图像生成工具,核心目标是解决AI生成图像时难以...

临时邮箱,一次性匿名gmail.com邮箱
有时候网站需要测试一些功能,比如注册登录等,需要用到邮箱,但是自己的邮箱有限,不能更多的测试效果,这时候就需要一些不同后缀的一次性邮箱,网上有很多这样的一次性匿名邮箱,后缀很多,非常适合测试使用,下面分享几个比较好用的临时邮箱。 Gmail...

免费AI视频生成软件FramePack整合包下载,本地离线AI图片转视频工具
前段时间阿里开源了一个AI视频生成工具WAN2.1,可以实现文本转视频和图片转视频,虽说很强大,但是测试之后感觉软件对电脑配置要求太高了,感觉应该大部分用户都用不了,而且只支持720P视频,清晰度有些低,所以没和大家分享。前些天又出了一个更...

PDF OCR图片文字内容识别软件OCRmyPDF下载,免费PDF扫描内容转可搜索可复制工具
本次和大家分享一个非常热门强大的PDF文件内容OCR识别软件OCRmyPDF,这个软件可以将PDF内不可搜索的图片和文字识别转换为可复制可搜索的文本,并对PDF文件进行优化。 OCRmyPDF介绍 OCRmyPDF 为扫描的 PDF 文件添...

免费音效音乐生成软件AudioX整合包下载,快速音效配音工具
本次分享一个非常强大的音乐音效生成软件AudioX,这个软件可以通过提供文本、视频、图像、音乐和音频自动识别内容重新生成一段高质量的通用音频和音乐。 AudioX介绍 音频和音乐生成已成为众多应用中的关键任务,然而现有方法面临诸多限制:它们...