Към основното съдържание
PPDF123

Извлечете изображенията от PDF

Извличане на изображения изважда вградените растерни изображения от PDF и ги предава в ZIP като PNG или JPEG файлове. Векторните рисунки и текстът на страницата не са изображения и не се включват.

Плъзнете файлове тук или кликнете, за да изберете

Приема PDF · до 500.0 MB на файл · до 20 файла наведнъж

Можете също да поставите файл с Ctrl/Cmd+V или от менюто на клипборда.

Извличане на изображения обхожда XObject изображенията на страниците, декодира Flate/ASCII85/DCT потоци и ги пакетира в ZIP като `image_N.png` или `image_N.jpeg`. `format` е png (подразбиране) или jpeg. Споделен XObject се извлича веднъж.

Изображения с LZW филтър връщат вътрешна грешка (`LZW images unsupported`). Страници без XObject речник се пропускат. Файл без извличаеми изображения пак може да върне ZIP без полезни членове.

Това не е рендиране на всяка страница като PNG («PDF към изображения») и не е OCR. Векторите не са image XObject и не се появяват.

Файловете, защитени с парола, се отключват вместо вас на тази страница, щом въведете паролата; при API първо пуснете «Премахване на парола».

Качванията са временни. Не пазим библиотека с изображения.

Възможности

  • XObject изображения в ZIP като PNG или JPEG
  • Дедупликация по object id; LZW не се поддържа
  • Не е цялостно растеризиране и не е OCR
  • Анонимен API: /api/v1/misc/extract-images

Кога да го използвате

  • Изваждане на снимки от електронен отчет
  • format=jpeg, когато искате да избегнете прекодиране на JPEG потоци
  • Само изображения, без цялостно растеризиране на страници

Как да извлека изображенията от PDF?

  1. Качете PDF с вградени снимки или растери.
  2. Запазете PNG или изберете JPEG.
  3. Стартирайте обработката и изтеглете `{name}_extracted_images.zip`.
  4. Ако ZIP е празен откъм полезни файлове, PDF няма декодируеми image XObject.

Ограничения и крайни случаи

  • Не е рендерер на страници
  • LZW проваля задачата
  • PNG изходът е RGB, затова прозрачността и меките маски се губят
  • Няма OCR
  • Ограничение за качване на този сайт: 500 MB на файл; над около 95 MB файлът се изпраща на части. Тялото на една пряка API заявка е ограничено до 100 MB.

Примери

  • PDF с три уникални фото XObject дава image_1…image_3 в ZIP
  • Страница с векторен лого може да не даде нищо

Поверителност при този инструмент

Файловете се качват по HTTPS, обработват се в паметта или в краткоживуща временна директория на нашите сървъри и се изтриват, щом резултатът е готов. Не задържаме копия за по-късен преглед, обучение на модели или рекламни профили. Сроковете за съхранение и обясненията за бисквитките на AdSense са в Политиката за поверителност.

Често задавани въпроси

Защо няма по една картинка на страница?
Извличат се само вградени image XObject. Страница с текст и вектори може да няма нито една.
Каква е разликата с PDF към изображения?
«PDF към изображения» рендира страници. «Извличане на изображения» вади вече вградените обекти.
А LZW?
Декодирането на LZW не е реализирано. Задачата греши, вместо да пропусне кадъра.
Обработват ли се маски и SMask?
Гледайте изхода като приблизителен пикселен експорт. Меки маски и редки цветови пространства може да са грешни.

Последна актуализация:

Извикване от код

Всеки инструмент е обикновен REST интерфейс. За анонимна употреба не трябват профил или API ключ. Работи еднакво в браузър, за разработчици и за AI агенти.

curl -X POST "https://pdf123.xyz/api/v1/misc/extract-images" \
  -F "[email protected]" \
  -F "format=png" \
  -o output.pdf

Наличен е и като MCP инструмент за клиенти с Model Context Protocol (JSON-RPC 2.0 през POST /mcp). Пълна API документация

Използвайте го чрез AI агент

Скил

С този скил Claude Code, Codex, Cursor и други AI агенти могат да изпълнят „Извличане на изображения“ вместо вас: /skills/pdf123-extract-images.md

Всички скилове за агенти

Файловете служат само за тази обработка и после се изтриват автоматично.