
一个命令跑通 MinerUPDF 转换实战笔记【免费下载链接】MinerUTransforms complex documents like PDFs and Office docs into LLM-ready markdown/JSON for your Agentic workflows.项目地址: https://gitcode.com/GitHub_Trending/mi/MinerU手里有份 200 页的扫描 PDF要转成能编辑的 Markdown手动复制行不通。MinerU 把 PDF、图片和 Office 文档解析成 LLM 能直接用的 Markdown 与 JSON。按你的硬件和场景选一条路装完就能转。装 core 就能跑MinerU 第一份 PDF 怎么转装完你手里多了一个mineru命令行工具输入 PDF、图片或 docx/pptx/xlsx输出 Markdown 和 JSON。core 模块把解析所需的全部依赖一次装齐模型首次运行时自动下载需要联网。uv pip install mineru[core] mineru -p input.pdf -o output/第二行跑通后output/下按页生成 Markdown。默认走 hybrid-engine 后端换 pipeline、vlm-engine 或调解析参数见 CLI 参数文档。有显卡才走这条路MinerU vllm 加速与显存配置门槛先说清Turing 架构及以上、显存 ≥8G不满足直接跳过本节。uv pip install mineru[all]在 Linux 上mineru[all]等价于 core vllm s3 合并安装一条命令到位。装完设两个环境变量export MINERU_DEVICE_MODEcuda export MINERU_VIRTUAL_VRAM_SIZE16 # 按实际显存改加速原理只记结论vllm 用 PagedAttention 管理 KV 缓存减少显存浪费批量推理比默认引擎快 3~5 倍。服务端实现在mineru/model/vlm/想抠细节再看。 本机算力不够轻量客户端连远程推理服务三种情况适用本机没显卡、不想装重依赖、只想连远程 vllm-server。服务端跑mineru-vllm-server客户端只装基础包体积 50MBuv pip install mineru mineru -p input.pdf -o output/ --backend vlm-http-client --url http://127.0.0.1:30000客户端把页面通过 HTTP 发给远端做推理本地只处理返回结果跑 200 页扫描件也不吃本机显存。整体架构与数据流见下图。这几个环境变量开关最常用默认配置能覆盖大多数文档想换模型下载源、限定显存上限、关掉公式或表格识别来省时间时才需要动下面这些开关。变量名干什么的常见取值MINERU_MODEL_SOURCE模型下载源modelscope / localMINERU_DEVICE_MODE设备模式cuda / cpuMINERU_VIRTUAL_VRAM_SIZE推理显存上限8 / 16MINERU_FORMULA_ENABLE公式解析开关true / falseMINERU_TABLE_ENABLE表格识别开关true / false完整列表在 CLI 参数文档 里。装不上、跑不对时先查这几种症状vllm 安装反复失败大概率是本地依赖版本冲突。别跟依赖死磕换预构建镜像看 Docker 部署指南。中文输出乱码文档语言没判对。跑转换时加-l ch指定语言OCR 准确率会直接上来。大文档显存溢出推理批量开大了。先把MINERU_VIRTUAL_VRAM_SIZE调小再用-s/-e分段转页面。都解决不了先翻 FAQ再不到去仓库 issue 区提单。个人日常转换core 加远程客户端就够批量任务或精度要求高走 vllm 那条路。想读源码git clone https://gitcode.com/GitHub_Trending/mi/MinerU【免费下载链接】MinerUTransforms complex documents like PDFs and Office docs into LLM-ready markdown/JSON for your Agentic workflows.项目地址: https://gitcode.com/GitHub_Trending/mi/MinerU创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考