跳到主要内容
PPDF123

把 PDF 转成 Markdown

PDF 转 Markdown 把 PDF 中已有的文字转成 .md 文件,能识别出标题、段落和列表时会保留下来。它不做 OCR,所以扫描页输出是空的。

把文件拖到这里,或点击选择

支持 PDF · 单个文件不超过 500.0 MB · 一次最多 20 个文件

也可以按 Ctrl/Cmd+V 或从剪贴板菜单粘贴文件。

PDF 转 Markdown 用 pdf-inspector 读取文件里已有的文字,返回 `.md` 下载(`text/markdown`)。目标是标题、段落和列表,不是像素级版面。

它不做 OCR。纯图像页常常是空的。扫描件请用 OCR 转 Markdown;那个工具看的是像素,输出同样是 `.md`。

阅读顺序可能和多栏视觉版面不一致。页眉可能每页重复,请在编辑器里删。PDF 里作为图像的公式不会变成 LaTeX。代码清单常常丢掉缩进。

这是给 docs-as-code、Git 差异和要文本的流水线用的转换器。印刷版面才是记录时,请保留 PDF。抽出的文字仍受版权约束;只转换你有权以文本再发布的文件。

有密码保护的文件,在你输入密码后会在本页为你解锁;API 调用方需先运行移除密码。打开 Markdown,提交前先修正标题层级。本站的 Markdown to PDF 是反向;来回一趟不会恢复原版面。

上传是临时的。我们不会保存你的 Markdown 文库。

功能

  • 用 pdf-inspector 抽取 PDF 原生文字为 Markdown
  • 不做 OCR;扫描件请用 OCR 工具
  • 下载为 `text/markdown`,文件名 `.md`
  • 匿名 API:/api/v1/convert/pdf/markdown

适用场景

  • 把 PDF README 放进 Git 仓库
  • 把文章正文送进提示词流水线
  • 从 PDF 简报起草网页文案

如何把 PDF 转成 Markdown?

  1. 优先用带文字的 PDF。扫描件请改用 OCR 转 Markdown。
  2. 上传 PDF,点击处理。
  3. 下载 `.md` 文件。
  4. 在编辑器里修正标题层级、重复页眉和表格。

限制与边界

  • 没有 OCR;纯图像页几乎抽不出内容
  • 版面保真有限
  • 复杂表格可能要手工改
  • 本网站的上传上限:每个文件 500 MB,超过约 95 MB 时分块上传。直接调用 API 时,单个请求体上限为 100 MB。

示例

  • 一份文字白皮书变成带段落和标题的 .md 文件
  • 未经 OCR 的扫描件几乎得不到可用的 Markdown

本工具的隐私说明

文件经 HTTPS 上传,在服务器内存或短期临时目录中处理,结果就绪后即删除。我们不会为日后浏览、训练或广告画像保留副本。留存期限与 AdSense Cookie 说明见隐私政策。

常见问题

为什么 Markdown 是空的?
这份 PDF 多半没有文字层。扫描件请用 OCR 转 Markdown。本工具只读文件里已有的文字。
这和 OCR 是一回事吗?
不是。OCR 看图像页。PDF 转 Markdown 用 pdf-inspector 读原生文字。
会保留字体吗?
Markdown 是文字加轻度结构。字体来自之后渲染 Markdown 的那一层。
能把 Markdown 再转回 PDF 吗?
可以,走 Markdown to PDF。版面对不上原来的 PDF。

最后更新:

用代码调用

本站每个工具都是普通 REST 接口。匿名使用不需要账号或 API Key,给浏览器、开发者和智能体同样可用。

curl -X POST "https://pdf123.xyz/api/v1/convert/pdf/markdown" \
  -F "[email protected]" \
  -o output.pdf

也提供 MCP 工具,供说 Model Context Protocol 的客户端调用(JSON-RPC 2.0,POST /mcp)。 完整 API 文档

在 AI 代理中使用

Skill

装上这个 Skill,Claude Code、Codex、Cursor 等 AI 代理就能替你完成「PDF 转 Markdown」: /skills/pdf123-pdf-to-markdown.md

全部 Agent Skill

文件只用于本次处理,完成后自动删除。