删除 PDF 中的空白页
删除空白页把 PDF 的页面分成空白和非空白两组,分别以 PDF 放进 ZIP 返回。一页在没有可提取的文字、也没有嵌入图像时算作空白。
把文件拖到这里,或点击选择
支持 PDF · 单个文件不超过 500.0 MB · 一次最多 20 个文件
也可以按 Ctrl/Cmd+V 或从剪贴板菜单粘贴文件。
删除空白页给每一页分类成空白或非空白,再返回 qpdf 子集的 ZIP。一页在没有可提取的文字、也没有嵌入图像时算作空白,所以只有矢量线条的页也算空白。`threshold` 字段对含有任何文字的页没有影响,`whitePercent` 读了然后丢掉。
两类都有时得到 `{base}_blank.pdf` 和 `{base}_nonblank.pdf`。全空白则 `{base}_allBlankPages.pdf`。全非空白则 `nonblank.pdf`。
这不是视觉白页检测,也不是 OCR。扫描表单若是一张图,会因为 `page_has_images` 为真而被当成非空白。只有矢量线条、没有文字的页看起来像印过,仍可能被当成空白。
有密码保护的文件,在你输入密码后会在本页为你解锁;API 调用方需先运行移除密码。
上传是临时的。我们不会保存你的 PDF 文库。
功能
- 文字加图像启发式;空白和/或非空白子集打成 ZIP
- 忽略 `whitePercent`;`threshold` 不影响含文字的页
- 纯图像扫描件视为非空白
- 匿名 API:/api/v1/misc/remove-blanks
适用场景
- 从电子版导出里抽出没有文字的分隔页
- 即使看起来发白,也把扫描图页留在一起
- 删任何东西之前先看 ZIP 里两份
如何删除 PDF 中的空白页?
- 上传 PDF。
- 别动 threshold 和 whitePercent;它们都不会改变哪些文字页或图像页被保留。
- 点击处理,下载 `{name}_removeBlanks.zip`。
- 若有两部分都打开看看,确认带图的页留在非空白里。
限制与边界
- 不是视觉空白检测
- 不是 OCR
- whitePercent 无用
- 本网站的上传上限:每个文件 500 MB,超过约 95 MB 时分块上传。直接调用 API 时,单个请求体上限为 100 MB。
示例
- 若干空文本页加一张扫描图,会得到一份空白文件加一份一页的非空白文件
- 全是图像的扫描件 ZIP 里往往只有 nonblank.pdf
本工具的隐私说明
文件经 HTTPS 上传,在服务器内存或短期临时目录中处理,结果就绪后即删除。我们不会为日后浏览、训练或广告画像保留副本。留存期限与 AdSense Cookie 说明见隐私政策。
常见问题
- 为什么看起来全白的扫描页还在?
- 它含有图像 XObject。分类器把任何有图的页当成非空白。
- whitePercent 99.9 有用吗?
- 没有。代码绑定了它然后忽略。
- 产出是删掉空白后的一份 PDF 吗?
- 不是。是可能含空白和非空白文件的 ZIP。
- 能先 OCR 再删空白吗?
- OCR 返回 Markdown,不是能送到这里的 PDF。
最后更新:
用代码调用
本站每个工具都是普通 REST 接口。匿名使用不需要账号或 API Key,给浏览器、开发者和智能体同样可用。
curl -X POST "https://pdf123.xyz/api/v1/misc/remove-blanks" \
-F "[email protected]" \
-F "threshold=10" \
-F "whitePercent=99.9" \
-o output.pdf也提供 MCP 工具,供说 Model Context Protocol 的客户端调用(JSON-RPC 2.0,POST /mcp)。 完整 API 文档
在 AI 代理中使用
Skill装上这个 Skill,Claude Code、Codex、Cursor 等 AI 代理就能替你完成「删除空白页」: /skills/pdf123-remove-blanks.md
文件只用于本次处理,完成后自动删除。