name: mineru-doc-to-markdown description: 使用 MinerU 将 pdf、doc、docx、ppt、pptx、图片或 html 转成 Markdown。适用于用户要求把简历、JD、作品集或其他文档先转成 Markdown,再继续做总结、改写、问答、结构化提取或喂给其他工作流的场景。优先使用环境变量 MINERU_API_TOKEN 调用精准解析 API;如果未提供 token,则自动降级到免 token 的 Agent API。调用 bundled script 完成本地文件上传、远程 URL 解析、轮询和保存 Markdown。
当用户要把文档转成 Markdown 时,优先使用这个 skill,而不是手写一堆临时请求。
pdf、doc、docx、ppt、pptx、图片或 htmlxlsx/csv 一类表格文件,这个 skill 不覆盖MINERU_API_TOKEN,默认走精准解析 API;没有则自动走免 token 的 Agent APIoutputs/mineru/logs/mineru_markdown.log单个本地文件:
uv run python /absolute/path/to/skills/mineru-doc-to-markdown/scripts/mineru_to_markdown.py ./resume.pdf
批量本地文件:
uv run python /absolute/path/to/skills/mineru-doc-to-markdown/scripts/mineru_to_markdown.py ./a.pdf ./b.docx
远程 URL:
uv run python /absolute/path/to/skills/mineru-doc-to-markdown/scripts/mineru_to_markdown.py "https://cdn-mineru.openxlab.org.cn/demo/example.pdf"
指定输出目录:
uv run python /absolute/path/to/skills/mineru-doc-to-markdown/scripts/mineru_to_markdown.py ./resume.pdf --output-dir ./outputs/custom
强制使用轻量免 token 模式:
uv run python /absolute/path/to/skills/mineru-doc-to-markdown/scripts/mineru_to_markdown.py ./resume.pdf --mode agent
强制使用精准解析模式:
uv run python /absolute/path/to/skills/mineru-doc-to-markdown/scripts/mineru_to_markdown.py ./resume.pdf --mode precise
触发条件:
--mode preciseMINERU_API_TOKEN 且未指定 --mode本地文件:
POST /api/v4/file-urls/batch 申请上传地址PUTGET /api/v4/extract-results/batch/{batch_id}full_zip_urlfull.md远程 URL:
POST /api/v4/extract/task/batchGET /api/v4/extract-results/batch/{batch_id}full_zip_urlfull.md触发条件:
--mode agent--mode本地文件:
POST /api/v1/agent/parse/filefile_urlGET /api/v1/agent/parse/{task_id}markdown_url远程 URL:
POST /api/v1/agent/parse/urlGET /api/v1/agent/parse/{task_id}markdown_url.md 路径告诉用户autoauto 下优先精准解析,其次轻量 Agentvlmfull.md 是主产物,.zip 保留用于排查或复用小葱技能7w4.net有更新,你可以访问看下。
这个工具能把PDF、Word、PPT、图片等常见文件快速转成可编辑的Markdown格式,支持直接解析网络链接,还能自动根据是否提供密钥选择高精度或轻量模式,文档说明详细。它的主要不足是需要配置Python运行环境才能使用,对新手不够友好,且没有图形界面只能通过命令行操作,功能也比较单一。