Przejdź do głównej treści
PPDF123

Wyodrębnianie obrazów z pliku PDF

Wyodrębnij obrazy wyjmuje z PDF osadzone obrazy rastrowe i dostarcza je w ZIP-ie jako pliki PNG lub JPEG. Rysunki wektorowe i tekst strony nie są obrazami i nie są uwzględniane.

Przeciągnij pliki tutaj albo kliknij, żeby wybrać

Obsługiwane: PDF · do 500.0 MB na plik · maks. 20 plików naraz

Możesz też wkleić plik przez Ctrl/Cmd+V lub z menu schowka.

Wyodrębnianie obrazów przechodzi obrazy XObject stron, dekoduje strumienie Flate/ASCII85/DCT i pakuje je do ZIP jako `image_N.png` lub `image_N.jpeg`. `format` wybiera png (domyślnie) lub jpeg. Współdzielone XObject są wyciągane raz.

Obrazy z filtrem LZW dają błąd wewnętrzny (`LZW images unsupported`). Strony bez słownika XObject są pomijane. Plik bez wyciągalnych obrazów i tak zwraca ZIP, który może nie mieć oczekiwanych członków.

To nie renderowanie każdej strony do PNG (to PDF na obrazy) i nie OCR. Grafika wektorowa nie jest XObject obrazu i się nie pojawi.

Pliki chronione hasłem są odblokowywane za Ciebie na tej stronie, gdy tylko wpiszesz hasło; wywołujący API najpierw uruchamiają Usuń hasło.

Przesłania są tymczasowe. Nie prowadzimy biblioteki Twoich obrazów.

Funkcje

  • Obrazy XObject w ZIP jako PNG lub JPEG
  • Deduplikacja po id obiektu; LZW nieobsługiwane
  • Nie rasteryzacja stron i nie OCR
  • Anonimowe API: /api/v1/misc/extract-images

Kiedy tego użyć

  • Wyciągnąć zdjęcia z elektronicznego raportu
  • Przy format=jpeg starać się nie przekodowywać strumieni JPEG
  • Wziąć same obrazy bez rasteryzacji całych stron

Jak wyodrębnić obrazy z PDF?

  1. Prześlij PDF z osadzonymi zdjęciami lub rastrami.
  2. Zostaw PNG albo wybierz JPEG.
  3. Kliknij Przetwórz i pobierz `{name}_extracted_images.zip`.
  4. Jeśli w ZIP nie ma użytecznych plików, PDF nie ma dekodowalnych obrazów XObject.

Ograniczenia i przypadki brzegowe

  • To nie narzędzie renderujące strony
  • LZW kończy zadanie błędem
  • Wyjściowy PNG jest w RGB, więc przezroczystość i miękkie maski są odrzucane
  • Bez OCR
  • Limit przesyłania na tej stronie: 500 MB na plik, wysyłane porcjami powyżej około 95 MB. Treść pojedynczego bezpośredniego żądania API jest ograniczona do 100 MB.

Przykłady

  • PDF z trzema unikalnymi XObject zdjęć daje w ZIP image_1 do image_3
  • Strona z logo wektorowym może nic nie wnieść

Prywatność tego narzędzia

Pliki są przesyłane przez HTTPS, przetwarzane w pamięci lub w krótkotrwałym katalogu tymczasowym na naszych serwerach i usuwane, gdy wynik jest gotowy. Nie przechowujemy kopii do późniejszego przeglądania, trenowania ani profili reklamowych. Szczegóły retencji i pliki cookie AdSense znajdują się w polityce prywatności.

Najczęstsze pytania

Dlaczego nie ma po jednym obrazie na stronę?
Wyciągane są tylko osadzone obrazy XObject. Strona z tekstem i wektorami może nie dać nic.
Czym różni się od PDF na obrazy?
PDF na obrazy renderuje strony. Wyodrębnij obrazy wyjmuje obiekty obrazów już w pliku.
A LZW?
Dekodowanie LZW nie jest zaimplementowane. Zadanie kończy się błędem, nie pomija jednego obrazu.
Czy maski i SMask są obsługiwane?
Traktuj wynik jako eksport pikseli na tyle, na ile się da. Miękkie maski i rzadsze przestrzenie kolorów mogą wyjść źle.

Ostatnia aktualizacja:

Wywołanie z kodu

Każde narzędzie na stronie to zwykły interfejs REST. Anonimowo nie trzeba konta ani klucza API. Działa w przeglądarce, u programistów i u agentów AI.

curl -X POST "https://pdf123.xyz/api/v1/misc/extract-images" \
  -F "[email protected]" \
  -F "format=png" \
  -o output.pdf

Dostępne też jako narzędzie MCP dla klientów mówiących Model Context Protocol (JSON-RPC 2.0, POST /mcp). Pełna dokumentacja API

Użyj go z agentem AI

Skill

Z tym skillem Claude Code, Codex, Cursor i inne agenty AI mogą wykonać za Ciebie „Wyodrębnij obrazy”: /skills/pdf123-extract-images.md

Wszystkie skille dla agentów

Pliki służą tylko do tego zadania i są potem automatycznie usuwane.