PDFに埋め込まれた画像を取り出す
画像の抽出は、PDFに埋め込まれたラスタ画像を取り出し、PNGまたはJPEGのファイルとしてZIPで渡します。ベクタの図形やページの文字は画像ではないため含まれません。
ファイルをここにドロップするか、クリックして選んでください
対応形式:PDF・1ファイル500.0 MBまで · 一度に最大20ファイル
Ctrl/Cmd+V またはクリップボードメニューからファイルを貼り付けることもできます。
画像の抽出 はページの XObject 画像を走査し、Flate/ASCII85/DCT ストリームを復号して、`image_N.png` または `image_N.jpeg` の ZIP にまとめます。`format` は png(既定)または jpeg。共有される XObject は 1 回だけ抽出します。
LZW フィルタの画像は内部エラー(`LZW images unsupported`)を返します。XObject 辞書のないページはスキップされます。抽出できる画像がないファイルでも ZIP は返り、欲しいメンバーが入っていないことがあります。
各ページを PNG に描画するのではありません(それは PDFから画像)。OCR でもありません。ベクタは画像 XObject ではないため出てきません。
パスワード保護されたファイルは、このページでパスワードを入力すると自動で解除されます。API を使う場合は先にパスワード解除を実行してください。
アップロードは一時的です。画像の書庫は保持しません。
機能
- XObject 画像を PNG または JPEG の ZIP に
- オブジェクト id で重複排除。LZW 非対応
- ページ全体のラスタライズでも OCR でもない
- 匿名 API:/api/v1/misc/extract-images
こんなときに使う
- 電子版レポートから写真を取り出す
- format=jpeg のとき JPEG 写真ストリームをできるだけ再符号化しない
- 図だけが必要で、ページ全体のラスタライズをしたくないとき
PDFから画像を抽出するには?
- 埋め込み写真やラスタ図のある PDF をアップロードします。
- PNG のままにするか、JPEG に切り替えます。
- 処理をクリックし、`{name}_extracted_images.zip` をダウンロードします。
- ZIP に有用なファイルがなければ、PDF に復号可能な画像 XObject がありません。
制限と注意点
- ページレンダラではない
- LZW はジョブを失敗させる
- PNG 出力は RGB のため、透明度とソフトマスクは失われる
- OCR なし
- このサイトのアップロード上限は 1 ファイルあたり 500 MB で、約 95 MB を超えると分割して送信されます。API への直接リクエスト 1 回の本文は 100 MB までです。
例
- 重複しない写真 XObject が 3 つある PDF なら、ZIP は image_1 から image_3
- ベクタのロゴページは何も出さないことがある
このツールのプライバシー
ファイルは HTTPS でアップロードされ、サーバーのメモリまたは短命の一時ディレクトリで処理され、結果の準備ができた時点で削除されます。後から閲覧・学習・広告プロファイル用にコピーは残しません。保持期間と AdSense Cookie の開示はプライバシーポリシーをご覧ください。
よくある質問
- なぜ 1 ページ 1 枚の画像にならないのですか?
- 埋め込みの画像 XObject だけを取り出します。文字とベクタだけのページは 1 枚も出ないことがあります。
- PDFから画像 との違いは?
- PDFから画像 はページを描画します。画像の抽出 はファイル内の既存画像オブジェクトを取り出します。
- LZW はどうなりますか?
- LZW 復号は未実装です。その 1 枚を飛ばすのではなく、ジョブがエラーになります。
- マスクと SMask は処理されますか?
- 出力はできる範囲のピクセル書き出しとして扱ってください。ソフトマスクや珍しい色空間は合わないことがあります。
最終更新:
コードから呼び出す
このサイトの各ツールは、通常のRESTエンドポイントです。匿名利用にアカウントやAPIキーは不要です。ブラウザだけでなく、AIエージェントや開発者向けにも使えます。
curl -X POST "https://pdf123.xyz/api/v1/misc/extract-images" \
-F "[email protected]" \
-F "format=png" \
-o output.pdfModel Context Protocolに対応したエージェント向けに、MCPツールとしても使えます(JSON-RPC 2.0、POST /mcp)。 APIリファレンス
AI エージェントから使う
スキルこのスキルを入れると、Claude Code、Codex、Cursor などの AI エージェントが「画像の抽出」を代わりに実行できます: /skills/pdf123-extract-images.md
ファイルはこの処理のためだけに使い、完了後に自動で削除します。