メインコンテンツへスキップ
PPDF123

PDFに埋め込まれた画像を取り出す

画像の抽出は、PDFに埋め込まれたラスタ画像を取り出し、PNGまたはJPEGのファイルとしてZIPで渡します。ベクタの図形やページの文字は画像ではないため含まれません。

ファイルをここにドロップするか、クリックして選んでください

対応形式:PDF・1ファイル500.0 MBまで · 一度に最大20ファイル

Ctrl/Cmd+V またはクリップボードメニューからファイルを貼り付けることもできます。

画像の抽出 はページの XObject 画像を走査し、Flate/ASCII85/DCT ストリームを復号して、`image_N.png` または `image_N.jpeg` の ZIP にまとめます。`format` は png(既定)または jpeg。共有される XObject は 1 回だけ抽出します。

LZW フィルタの画像は内部エラー(`LZW images unsupported`)を返します。XObject 辞書のないページはスキップされます。抽出できる画像がないファイルでも ZIP は返り、欲しいメンバーが入っていないことがあります。

各ページを PNG に描画するのではありません(それは PDFから画像)。OCR でもありません。ベクタは画像 XObject ではないため出てきません。

パスワード保護されたファイルは、このページでパスワードを入力すると自動で解除されます。API を使う場合は先にパスワード解除を実行してください。

アップロードは一時的です。画像の書庫は保持しません。

機能

  • XObject 画像を PNG または JPEG の ZIP に
  • オブジェクト id で重複排除。LZW 非対応
  • ページ全体のラスタライズでも OCR でもない
  • 匿名 API:/api/v1/misc/extract-images

こんなときに使う

  • 電子版レポートから写真を取り出す
  • format=jpeg のとき JPEG 写真ストリームをできるだけ再符号化しない
  • 図だけが必要で、ページ全体のラスタライズをしたくないとき

PDFから画像を抽出するには?

  1. 埋め込み写真やラスタ図のある PDF をアップロードします。
  2. PNG のままにするか、JPEG に切り替えます。
  3. 処理をクリックし、`{name}_extracted_images.zip` をダウンロードします。
  4. ZIP に有用なファイルがなければ、PDF に復号可能な画像 XObject がありません。

制限と注意点

  • ページレンダラではない
  • LZW はジョブを失敗させる
  • PNG 出力は RGB のため、透明度とソフトマスクは失われる
  • OCR なし
  • このサイトのアップロード上限は 1 ファイルあたり 500 MB で、約 95 MB を超えると分割して送信されます。API への直接リクエスト 1 回の本文は 100 MB までです。

例

  • 重複しない写真 XObject が 3 つある PDF なら、ZIP は image_1 から image_3
  • ベクタのロゴページは何も出さないことがある

このツールのプライバシー

ファイルは HTTPS でアップロードされ、サーバーのメモリまたは短命の一時ディレクトリで処理され、結果の準備ができた時点で削除されます。後から閲覧・学習・広告プロファイル用にコピーは残しません。保持期間と AdSense Cookie の開示はプライバシーポリシーをご覧ください。

よくある質問

なぜ 1 ページ 1 枚の画像にならないのですか?
埋め込みの画像 XObject だけを取り出します。文字とベクタだけのページは 1 枚も出ないことがあります。
PDFから画像 との違いは?
PDFから画像 はページを描画します。画像の抽出 はファイル内の既存画像オブジェクトを取り出します。
LZW はどうなりますか?
LZW 復号は未実装です。その 1 枚を飛ばすのではなく、ジョブがエラーになります。
マスクと SMask は処理されますか?
出力はできる範囲のピクセル書き出しとして扱ってください。ソフトマスクや珍しい色空間は合わないことがあります。

最終更新:

コードから呼び出す

このサイトの各ツールは、通常のRESTエンドポイントです。匿名利用にアカウントやAPIキーは不要です。ブラウザだけでなく、AIエージェントや開発者向けにも使えます。

curl -X POST "https://pdf123.xyz/api/v1/misc/extract-images" \
  -F "[email protected]" \
  -F "format=png" \
  -o output.pdf

Model Context Protocolに対応したエージェント向けに、MCPツールとしても使えます(JSON-RPC 2.0、POST /mcp)。 APIリファレンス

AI エージェントから使う

スキル

このスキルを入れると、Claude Code、Codex、Cursor などの AI エージェントが「画像の抽出」を代わりに実行できます: /skills/pdf123-extract-images.md

すべてのエージェント用スキル

ファイルはこの処理のためだけに使い、完了後に自動で削除します。