从 PDF 中提取图片
提取图片把 PDF 中内嵌的栅格图片取出来,以 PNG 或 JPEG 文件打包进 ZIP 交给你。矢量图形和页面文字不是图片,不会包含在内。
把文件拖到这里,或点击选择
支持 PDF · 单个文件不超过 500.0 MB · 一次最多 20 个文件
也可以按 Ctrl/Cmd+V 或从剪贴板菜单粘贴文件。
提取图片遍历页面 XObject 图像,解码 Flate/ASCII85/DCT 流,打成 `image_N.png` 或 `image_N.jpeg` 的 ZIP。`format` 选 png(默认)或 jpeg。共用的 XObject 只抽一次。
LZW 过滤的图返回内部错误(`LZW images unsupported`)。没有 XObject 字典的页会跳过。没有可抽取图的文件仍返回 ZIP,里面可能没有你要的成员。
这不是把每一页渲成 PNG(那是 PDF 转图片),也不是 OCR。矢量不是图像 XObject,不会出现。
有密码保护的文件,在你输入密码后会在本页为你解锁;API 调用方需先运行移除密码。
上传是临时的。我们不会保存你的图片文库。
功能
- XObject 图像打成 PNG 或 JPEG 的 ZIP
- 按对象 id 去重;不支持 LZW
- 不是整页栅格化,也不是 OCR
- 匿名 API:/api/v1/misc/extract-images
适用场景
- 从电子版报告里抽出照片
- format=jpeg 时尽量不重编码 JPEG 照片流
- 只要图、不想整页栅格化时
如何从 PDF 中提取图片?
- 上传内嵌照片或栅格图的 PDF。
- 保留 PNG,或改选 JPEG。
- 点击处理,下载 `{name}_extracted_images.zip`。
- 若 ZIP 里没有有用的文件,说明 PDF 没有可解码的图像 XObject。
限制与边界
- 不是页面渲染器
- LZW 会让任务失败
- PNG 输出为 RGB,透明度和软遮罩会被丢弃
- 没有 OCR
- 本网站的上传上限:每个文件 500 MB,超过约 95 MB 时分块上传。直接调用 API 时,单个请求体上限为 100 MB。
示例
- 有三张不重复照片 XObject 的 PDF,ZIP 里是 image_1 到 image_3
- 矢量徽标页可能什么都不贡献
本工具的隐私说明
文件经 HTTPS 上传,在服务器内存或短期临时目录中处理,结果就绪后即删除。我们不会为日后浏览、训练或广告画像保留副本。留存期限与 AdSense Cookie 说明见隐私政策。
常见问题
- 为什么不是一页一张图?
- 只抽内嵌的图像 XObject。一页若是文字加矢量,可能一张都没有。
- 和 PDF 转图片有什么不同?
- PDF 转图片渲染页面。提取图片是把文件里已有的图像对象拿出来。
- LZW 呢?
- LZW 解码未实现。任务会报错,而不是跳过那一张。
- 遮罩和 SMask 会处理吗?
- 把产出当成尽力而为的像素导出。软遮罩和少见色彩空间可能不对。
最后更新:
用代码调用
本站每个工具都是普通 REST 接口。匿名使用不需要账号或 API Key,给浏览器、开发者和智能体同样可用。
curl -X POST "https://pdf123.xyz/api/v1/misc/extract-images" \
-F "[email protected]" \
-F "format=png" \
-o output.pdf也提供 MCP 工具,供说 Model Context Protocol 的客户端调用(JSON-RPC 2.0,POST /mcp)。 完整 API 文档
在 AI 代理中使用
Skill装上这个 Skill,Claude Code、Codex、Cursor 等 AI 代理就能替你完成「提取图片」: /skills/pdf123-extract-images.md
文件只用于本次处理,完成后自动删除。