跳到主要内容
PPDF123

把扫描版 PDF 用 OCR 转成 Markdown

OCR 转 Markdown 读取扫描版或纯图像的 PDF,把其中的文字以 Markdown 文件返回。它不会给 PDF 添加文字层,原文件保持不变。

把文件拖到这里,或点击选择

支持 PDF · 单个文件不超过 500.0 MB · 一次最多 20 个文件

也可以按 Ctrl/Cmd+V 或从剪贴板菜单粘贴文件。

OCR 读取扫描件或纯图像 PDF,返回 Markdown(`text/markdown`,文件名 `.md`)。它不会把隐藏文字层写回 PDF,也不会清理、纠偏或改写扫描件。

服务端把 PDF 里已有的原生文字,与图像页的光学识别结果拼在一起。Force OCR(`ocrType=force-ocr`,网站默认)会重识别每一页。Normal(只要不是 `force-ocr`)有原生文字就用原生文字,只对纯图页做 OCR。干净的电子版 PDF 上,Auto 不会加载 OCR 运行时。

准确度取决于扫描质量、对比度和倾斜。当前引擎没有语言参数。客户端若仍发送旧 Java OCRmyPDF 字段(`languages`、`deskew`、`clean`、`sidecar`),会被忽略。

这不是转 Word 或 PDF 转文本的前置步骤。那些工具仍然需要 PDF 内部已有文字。这里的 OCR 是平行抽取:你得到 Markdown,原 PDF 不变。

不要对无权数字化或再分发的文件做 OCR。抽出的文字同样受版权和工作场所规则约束。

想要一份可检索 PDF 的人,这里给不了。可检索的产物是 Markdown 文件。用编辑器打开,抽查必须准确的姓名和数字。

手机拍照尽量先裁切、摆正再上传。梯形拍页会把识别浪费在背景上。OCR 不是翻译:它识别字符,不会把文档改写成另一种语言。

任务在服务端运行。请及时下载。我们不会把你的文件做成 OCR 文库。有密码保护的文件,在你输入密码后会在本页为你解锁;API 调用方需先运行移除密码。

功能

  • 返回 Markdown,不是带 OCR 层的 PDF
  • Force OCR 重读每一页;Normal/Auto 有原生文字就用原生文字
  • 原 PDF 不变
  • 匿名 API:/api/v1/misc/ocr-pdf

适用场景

  • 从档案扫描件抽出条款文字
  • 把扫描件交给需要 Markdown 的智能体或流水线
  • 纯图像 PDF 没有文字层时把字取回来

如何对扫描版 PDF 做 OCR?

  1. 上传扫描件或手机拍摄的 PDF。
  2. 选择 Force OCR(默认)或 Normal/Auto。
  3. 点击处理,下载 `.md` 文件。
  4. 在 Markdown 里抽查姓名和数字后再使用。

限制与边界

  • 准确度随图像质量变化
  • 页数很多时耗时更长
  • 当前引擎没有语言参数
  • 不是本地 OCR 库,也不是离线 SDK
  • 本网站的上传上限:每个文件 500 MB,超过约 95 MB 时分块上传。直接调用 API 时,单个请求体上限为 100 MB。

示例

  • 一份 20 页灰度合同扫描件,变成条款文字的 Markdown 文件
  • 倾斜的手机拍页可能要重拍,OCR 才有用

本工具的隐私说明

文件经 HTTPS 上传,在服务器内存或短期临时目录中处理,结果就绪后即删除。我们不会为日后浏览、训练或广告画像保留副本。留存期限与 AdSense Cookie 说明见隐私政策。

常见问题

OCR 会改变页面外观吗?
它不返回 PDF。原文件不变;你另外得到一份 Markdown 下载。
这是可以嵌入的 OCR 库吗?
不是。这是托管在 /api/v1/misc/ocr-pdf 的 HTTP 任务。见 /developers。它不是可链接的 SDK。
OCR 之后能再转 Word 吗?
不能当成 PDF 流水线来接。OCR 输出是 Markdown。转 Word 仍然需要带文字层的 PDF。
电子版 PDF 需要 Force OCR 吗?
通常不需要。Normal/Auto 会用已有文字并跳过 OCR 运行时。文字层损坏或不可信时再用 Force。

最后更新:

用代码调用

本站每个工具都是普通 REST 接口。匿名使用不需要账号或 API Key,给浏览器、开发者和智能体同样可用。

curl -X POST "https://pdf123.xyz/api/v1/misc/ocr-pdf" \
  -F "[email protected]" \
  -F "ocrType=force-ocr" \
  -o output.pdf

也提供 MCP 工具,供说 Model Context Protocol 的客户端调用(JSON-RPC 2.0,POST /mcp)。 完整 API 文档

在 AI 代理中使用

Skill

装上这个 Skill,Claude Code、Codex、Cursor 等 AI 代理就能替你完成「OCR 转 Markdown」: /skills/pdf123-ocr.md

全部 Agent Skill

文件只用于本次处理,完成后自动删除。