把 PDF 转成 Markdown
PDF 转 Markdown 把 PDF 中已有的文字转成 .md 文件,能识别出标题、段落和列表时会保留下来。它不做 OCR,所以扫描页输出是空的。
把文件拖到这里,或点击选择
支持 PDF · 单个文件不超过 500.0 MB · 一次最多 20 个文件
也可以按 Ctrl/Cmd+V 或从剪贴板菜单粘贴文件。
PDF 转 Markdown 用 pdf-inspector 读取文件里已有的文字,返回 `.md` 下载(`text/markdown`)。目标是标题、段落和列表,不是像素级版面。
它不做 OCR。纯图像页常常是空的。扫描件请用 OCR 转 Markdown;那个工具看的是像素,输出同样是 `.md`。
阅读顺序可能和多栏视觉版面不一致。页眉可能每页重复,请在编辑器里删。PDF 里作为图像的公式不会变成 LaTeX。代码清单常常丢掉缩进。
这是给 docs-as-code、Git 差异和要文本的流水线用的转换器。印刷版面才是记录时,请保留 PDF。抽出的文字仍受版权约束;只转换你有权以文本再发布的文件。
有密码保护的文件,在你输入密码后会在本页为你解锁;API 调用方需先运行移除密码。打开 Markdown,提交前先修正标题层级。本站的 Markdown to PDF 是反向;来回一趟不会恢复原版面。
上传是临时的。我们不会保存你的 Markdown 文库。
功能
- 用 pdf-inspector 抽取 PDF 原生文字为 Markdown
- 不做 OCR;扫描件请用 OCR 工具
- 下载为 `text/markdown`,文件名 `.md`
- 匿名 API:/api/v1/convert/pdf/markdown
适用场景
- 把 PDF README 放进 Git 仓库
- 把文章正文送进提示词流水线
- 从 PDF 简报起草网页文案
如何把 PDF 转成 Markdown?
- 优先用带文字的 PDF。扫描件请改用 OCR 转 Markdown。
- 上传 PDF,点击处理。
- 下载 `.md` 文件。
- 在编辑器里修正标题层级、重复页眉和表格。
限制与边界
- 没有 OCR;纯图像页几乎抽不出内容
- 版面保真有限
- 复杂表格可能要手工改
- 本网站的上传上限:每个文件 500 MB,超过约 95 MB 时分块上传。直接调用 API 时,单个请求体上限为 100 MB。
示例
- 一份文字白皮书变成带段落和标题的 .md 文件
- 未经 OCR 的扫描件几乎得不到可用的 Markdown
本工具的隐私说明
文件经 HTTPS 上传,在服务器内存或短期临时目录中处理,结果就绪后即删除。我们不会为日后浏览、训练或广告画像保留副本。留存期限与 AdSense Cookie 说明见隐私政策。
常见问题
- 为什么 Markdown 是空的?
- 这份 PDF 多半没有文字层。扫描件请用 OCR 转 Markdown。本工具只读文件里已有的文字。
- 这和 OCR 是一回事吗?
- 不是。OCR 看图像页。PDF 转 Markdown 用 pdf-inspector 读原生文字。
- 会保留字体吗?
- Markdown 是文字加轻度结构。字体来自之后渲染 Markdown 的那一层。
- 能把 Markdown 再转回 PDF 吗?
- 可以,走 Markdown to PDF。版面对不上原来的 PDF。
最后更新:
用代码调用
本站每个工具都是普通 REST 接口。匿名使用不需要账号或 API Key,给浏览器、开发者和智能体同样可用。
curl -X POST "https://pdf123.xyz/api/v1/convert/pdf/markdown" \
-F "[email protected]" \
-o output.pdf也提供 MCP 工具,供说 Model Context Protocol 的客户端调用(JSON-RPC 2.0,POST /mcp)。 完整 API 文档
在 AI 代理中使用
Skill装上这个 Skill,Claude Code、Codex、Cursor 等 AI 代理就能替你完成「PDF 转 Markdown」: /skills/pdf123-pdf-to-markdown.md
文件只用于本次处理,完成后自动删除。