跳到主要内容
PPDF123

从 PDF 中提取图片

提取图片把 PDF 中内嵌的栅格图片取出来,以 PNG 或 JPEG 文件打包进 ZIP 交给你。矢量图形和页面文字不是图片,不会包含在内。

把文件拖到这里,或点击选择

支持 PDF · 单个文件不超过 500.0 MB · 一次最多 20 个文件

也可以按 Ctrl/Cmd+V 或从剪贴板菜单粘贴文件。

提取图片遍历页面 XObject 图像,解码 Flate/ASCII85/DCT 流,打成 `image_N.png` 或 `image_N.jpeg` 的 ZIP。`format` 选 png(默认)或 jpeg。共用的 XObject 只抽一次。

LZW 过滤的图返回内部错误(`LZW images unsupported`)。没有 XObject 字典的页会跳过。没有可抽取图的文件仍返回 ZIP,里面可能没有你要的成员。

这不是把每一页渲成 PNG(那是 PDF 转图片),也不是 OCR。矢量不是图像 XObject,不会出现。

有密码保护的文件,在你输入密码后会在本页为你解锁;API 调用方需先运行移除密码。

上传是临时的。我们不会保存你的图片文库。

功能

  • XObject 图像打成 PNG 或 JPEG 的 ZIP
  • 按对象 id 去重;不支持 LZW
  • 不是整页栅格化,也不是 OCR
  • 匿名 API:/api/v1/misc/extract-images

适用场景

  • 从电子版报告里抽出照片
  • format=jpeg 时尽量不重编码 JPEG 照片流
  • 只要图、不想整页栅格化时

如何从 PDF 中提取图片?

  1. 上传内嵌照片或栅格图的 PDF。
  2. 保留 PNG,或改选 JPEG。
  3. 点击处理,下载 `{name}_extracted_images.zip`。
  4. 若 ZIP 里没有有用的文件,说明 PDF 没有可解码的图像 XObject。

限制与边界

  • 不是页面渲染器
  • LZW 会让任务失败
  • PNG 输出为 RGB,透明度和软遮罩会被丢弃
  • 没有 OCR
  • 本网站的上传上限:每个文件 500 MB,超过约 95 MB 时分块上传。直接调用 API 时,单个请求体上限为 100 MB。

示例

  • 有三张不重复照片 XObject 的 PDF,ZIP 里是 image_1 到 image_3
  • 矢量徽标页可能什么都不贡献

本工具的隐私说明

文件经 HTTPS 上传,在服务器内存或短期临时目录中处理,结果就绪后即删除。我们不会为日后浏览、训练或广告画像保留副本。留存期限与 AdSense Cookie 说明见隐私政策。

常见问题

为什么不是一页一张图?
只抽内嵌的图像 XObject。一页若是文字加矢量,可能一张都没有。
和 PDF 转图片有什么不同?
PDF 转图片渲染页面。提取图片是把文件里已有的图像对象拿出来。
LZW 呢?
LZW 解码未实现。任务会报错,而不是跳过那一张。
遮罩和 SMask 会处理吗?
把产出当成尽力而为的像素导出。软遮罩和少见色彩空间可能不对。

最后更新:

用代码调用

本站每个工具都是普通 REST 接口。匿名使用不需要账号或 API Key,给浏览器、开发者和智能体同样可用。

curl -X POST "https://pdf123.xyz/api/v1/misc/extract-images" \
  -F "[email protected]" \
  -F "format=png" \
  -o output.pdf

也提供 MCP 工具,供说 Model Context Protocol 的客户端调用(JSON-RPC 2.0,POST /mcp)。 完整 API 文档

在 AI 代理中使用

Skill

装上这个 Skill,Claude Code、Codex、Cursor 等 AI 代理就能替你完成「提取图片」: /skills/pdf123-extract-images.md

全部 Agent Skill

文件只用于本次处理,完成后自动删除。