今天和大家分享一个PDF文件转Markdown格式软件MinerU,这个软件可以同时将一个pdf或是多个pdf文件批量转换成md格式和JSON格式文件,本软件为免费开源软件,原项目地址:https://github.com/opendatalab/MinerU,原应用是通过终端运行命令执行相应功能的,我做了个UI界面,如图所示:

主要特点
- 删除页眉、页脚、脚注和页码等元素,同时保持语义连续性
- 从多列文档中以人类可读的顺序输出文本
- 保留文档的原始结构,包括标题、段落和列表
- 提取图像、图像说明、表格和表格说明
- 自动识别文档中的公式并将其转换为 LaTeX
- 自动识别文档中的表格并将其转换为 LaTeX
- 自动检测并启用损坏 PDF 的 OCR
- 支持 CPU 和 GPU 环境
- 支持 Windows、Linux 和 Mac 平台(我打包版本只支持Windows)
软件操作也很简单,先选择PDF文件或是pdf所在文件夹,注意如果是选择文件夹的话路径末尾不能有”\”,再选择保存位置,处理方法默认auto,另外还有ocr和txt,如果正在处理包含大量公式的 PDF,强烈建议启用 OCR 功能。
如果有高配显卡的话,可以选择GPU模式速度更快,没有的话可以选择CPU模式,点击开始处理按钮,处理完成后在输出文件夹内就可以看到输出结果md和JSON格式文件
本整合包只支持Windows电脑版,不支持手机和mac,有需要的可以自己去测试。
2024-09-16更新
MinerU在9月12日发布了0.8.1版本,同时在14日发布了新的模型文件,所以我重新制作了最新版的一键启动整合包
新的整合包UI界面增加了表格操作的相关选项,如果你的PDF中有大量表格的话,可以通过开启表格识别功能增加导出效果
软件默认处理最大时间为400秒,也就是说如果超过400秒,你的转换任务还没有完成,那么软件可能会报错。所以请根据你的电脑配置合理安排每次识别PDF的数量
2024-11-24更新v0.10.0
我更新了最新0.10.0版本整合包,详情查看《最新版PDF转Markdown格式软件MinerU一键启动整合包v0.10.0下载》
PDF格式转Markdown软件MinerU一键启动整合包下载:
相关推荐
图片/PDF转HTML/Markdown/JSON软件Chandra—— Windows 版一键启动包,免安装部署,可离线
字节跳动Dolphin图片文档解析工具免安装一键启动整合包下载,PDF转JSON/Markdown软件
PDF/图片转markdown软件MonkeyOCR整合包,文档图片解析工具下载
微软PDF/WORD/HTML文档转Markdown格式软件markitdown整合包下载
PDF转Markdown软件MinerU 2.5.4版整合包使用说明视频教程
PDF转Markdown/JSON软件MinerU最新3.1.11版一键启动整合包下载
PDF/EPUB转Markdown/HTML软件Marker v1.6.1 2025-03-21版
PDF转Markdown软件zerox整合包,利用在线大语言模型识别转换PDF内容
最近更新
PDF转Markdown软件MinerU 3.1.11整合包(高性能版)
MinerU是一款非常热门的PDF、图片、DOCX、PPTX、XLSX转markdown格式软件,转换效果属于同类软件中比较优秀的一个。当前最新版为3.1.11版本,我基于最新版源码制作了免安装一键启动整合包,并做适当优化及修改,详情查看链...
阿里千问Qwen3-TTS声音克隆语音合成软件【低配电脑版】
阿里千问Qwen3-TTS是一款热门的语音合成及声音克隆软件,我基于当前最新版制作了免安装一键启动整合包,并增加多人对话语音合成功能。 此版本为低配显卡电脑版,软件使用0.6B模型,模型尺寸略小,对电脑显卡配置要求也更小,但是质量不会差太多...

腾讯混元三维世界重建系统WorldMirror 2.0通用3D三维资产重建工具下载
WorldMirror 2.0 是由腾讯混元(Hunyuan)团队开发的下一代通用三维世界重建系统,底层基于 HY-World-2.0 模型。它能够从一组普通照片或一段视频中,自动恢复出场景的三维结构,并生成多种形式的三维资产,包括: 我基...

阿里Qwen3-TTS高质量声音克隆语音合成系统,AI视频配音多人对话生成工具
Qwen3-TTS 是由阿里 Qwen 团队开发的新一代语音合成系统,基于自研的 Qwen3-TTS-Tokenizer-12Hz 编解码器和离散多码本 LM 架构,实现了端到端的全信息语音建模。它突破了传统级联架构的信息瓶颈,支持音色克隆...

PasteMD:一键将 Markdown 和网页 AI 对话文本内容粘贴到 Word、WPS 和 Excel
PasteMD:一键将 Markdown 和网页 AI 对话(ChatGPT/DeepSeek等)完美粘贴到 Word、WPS 和 Excel 的效率工具。 在写论文或报告时,从 ChatGPT / DeepSeek 等 AI 网站中复制出...

BiliNote:自动生成B站油管视频笔记,AI视频内容总结工具
在信息爆炸的时代,视频已经成为最重要的知识载体之一。但相比文字,视频的“可检索性”和“复用效率”始终较低。如何快速从长视频中提取重点、形成结构化知识,成为很多学习者和创作者的痛点。 而 BiliNote 正是为解决这一问题而诞生的一款开源 ...

优云智算HappyHorse AI 视频生成API KEY WebUI
大家可能平常刷视频的时候已经发现了,进入2026年AI短剧极其火爆,不管是短视频平台还是拼多多等购物平台,短剧视频里经常能刷到AI漫剧。前几年短剧公司拍真人短剧赚的盆满钵满,进入2026年短剧公司被AI打的毫无还手之力。借助AI的快速发展,...

LTX-2.3 视频生成免安装部署整合包软件下载
LTX-2 是由 Lightricks 开发的首个基于 DiT(扩散变换器)架构的音视频基础模型,能够在一个统一模型中同时生成高质量的视频与同步音频。与以往需要分别处理视频和音频的方案不同,LTX-2 将两者深度融合,实现真正的音画同步生成...
windows电脑剪贴板内容管理工具Ditto下载,快速粘贴预设文字内容回复话术
和大家分享一个windows电脑剪贴板内容管理神器Ditto,软件可以快速将预设文字内容填充到指定位置。 由于每天都要写大量文字,有时候还是重复内容,频繁到其它地方复制粘贴的话比较耗时间,所以找到了这款软件,首先佩服一下软件作者,这个软件维...
PDF转word软件FreeP2W免安装版下载
这软件还是很早的时候一个用户让做的,发现没分享过,现在分享一下。 软件主要功能就是把PDF文档转换为word文档 软件使用很简单,把需要处理的pdf文档复制到input文件夹内,双击启动软件.exe,等待处理完成即可。 注意事项 软件只支持...















