Извлечете изображенията от PDF
Извличане на изображения изважда вградените растерни изображения от PDF и ги предава в ZIP като PNG или JPEG файлове. Векторните рисунки и текстът на страницата не са изображения и не се включват.
Плъзнете файлове тук или кликнете, за да изберете
Приема PDF · до 500.0 MB на файл · до 20 файла наведнъж
Можете също да поставите файл с Ctrl/Cmd+V или от менюто на клипборда.
Извличане на изображения обхожда XObject изображенията на страниците, декодира Flate/ASCII85/DCT потоци и ги пакетира в ZIP като `image_N.png` или `image_N.jpeg`. `format` е png (подразбиране) или jpeg. Споделен XObject се извлича веднъж.
Изображения с LZW филтър връщат вътрешна грешка (`LZW images unsupported`). Страници без XObject речник се пропускат. Файл без извличаеми изображения пак може да върне ZIP без полезни членове.
Това не е рендиране на всяка страница като PNG («PDF към изображения») и не е OCR. Векторите не са image XObject и не се появяват.
Файловете, защитени с парола, се отключват вместо вас на тази страница, щом въведете паролата; при API първо пуснете «Премахване на парола».
Качванията са временни. Не пазим библиотека с изображения.
Възможности
- XObject изображения в ZIP като PNG или JPEG
- Дедупликация по object id; LZW не се поддържа
- Не е цялостно растеризиране и не е OCR
- Анонимен API: /api/v1/misc/extract-images
Кога да го използвате
- Изваждане на снимки от електронен отчет
- format=jpeg, когато искате да избегнете прекодиране на JPEG потоци
- Само изображения, без цялостно растеризиране на страници
Как да извлека изображенията от PDF?
- Качете PDF с вградени снимки или растери.
- Запазете PNG или изберете JPEG.
- Стартирайте обработката и изтеглете `{name}_extracted_images.zip`.
- Ако ZIP е празен откъм полезни файлове, PDF няма декодируеми image XObject.
Ограничения и крайни случаи
- Не е рендерер на страници
- LZW проваля задачата
- PNG изходът е RGB, затова прозрачността и меките маски се губят
- Няма OCR
- Ограничение за качване на този сайт: 500 MB на файл; над около 95 MB файлът се изпраща на части. Тялото на една пряка API заявка е ограничено до 100 MB.
Примери
- PDF с три уникални фото XObject дава image_1…image_3 в ZIP
- Страница с векторен лого може да не даде нищо
Поверителност при този инструмент
Файловете се качват по HTTPS, обработват се в паметта или в краткоживуща временна директория на нашите сървъри и се изтриват, щом резултатът е готов. Не задържаме копия за по-късен преглед, обучение на модели или рекламни профили. Сроковете за съхранение и обясненията за бисквитките на AdSense са в Политиката за поверителност.
Често задавани въпроси
- Защо няма по една картинка на страница?
- Извличат се само вградени image XObject. Страница с текст и вектори може да няма нито една.
- Каква е разликата с PDF към изображения?
- «PDF към изображения» рендира страници. «Извличане на изображения» вади вече вградените обекти.
- А LZW?
- Декодирането на LZW не е реализирано. Задачата греши, вместо да пропусне кадъра.
- Обработват ли се маски и SMask?
- Гледайте изхода като приблизителен пикселен експорт. Меки маски и редки цветови пространства може да са грешни.
Последна актуализация:
Извикване от код
Всеки инструмент е обикновен REST интерфейс. За анонимна употреба не трябват профил или API ключ. Работи еднакво в браузър, за разработчици и за AI агенти.
curl -X POST "https://pdf123.xyz/api/v1/misc/extract-images" \
-F "[email protected]" \
-F "format=png" \
-o output.pdfНаличен е и като MCP инструмент за клиенти с Model Context Protocol (JSON-RPC 2.0 през POST /mcp). Пълна API документация
Използвайте го чрез AI агент
СкилС този скил Claude Code, Codex, Cursor и други AI агенти могат да изпълнят „Извличане на изображения“ вместо вас: /skills/pdf123-extract-images.md
Файловете служат само за тази обработка и после се изтриват автоматично.