Wyodrębnianie obrazów z pliku PDF
Wyodrębnij obrazy wyjmuje z PDF osadzone obrazy rastrowe i dostarcza je w ZIP-ie jako pliki PNG lub JPEG. Rysunki wektorowe i tekst strony nie są obrazami i nie są uwzględniane.
Przeciągnij pliki tutaj albo kliknij, żeby wybrać
Obsługiwane: PDF · do 500.0 MB na plik · maks. 20 plików naraz
Możesz też wkleić plik przez Ctrl/Cmd+V lub z menu schowka.
Wyodrębnianie obrazów przechodzi obrazy XObject stron, dekoduje strumienie Flate/ASCII85/DCT i pakuje je do ZIP jako `image_N.png` lub `image_N.jpeg`. `format` wybiera png (domyślnie) lub jpeg. Współdzielone XObject są wyciągane raz.
Obrazy z filtrem LZW dają błąd wewnętrzny (`LZW images unsupported`). Strony bez słownika XObject są pomijane. Plik bez wyciągalnych obrazów i tak zwraca ZIP, który może nie mieć oczekiwanych członków.
To nie renderowanie każdej strony do PNG (to PDF na obrazy) i nie OCR. Grafika wektorowa nie jest XObject obrazu i się nie pojawi.
Pliki chronione hasłem są odblokowywane za Ciebie na tej stronie, gdy tylko wpiszesz hasło; wywołujący API najpierw uruchamiają Usuń hasło.
Przesłania są tymczasowe. Nie prowadzimy biblioteki Twoich obrazów.
Funkcje
- Obrazy XObject w ZIP jako PNG lub JPEG
- Deduplikacja po id obiektu; LZW nieobsługiwane
- Nie rasteryzacja stron i nie OCR
- Anonimowe API: /api/v1/misc/extract-images
Kiedy tego użyć
- Wyciągnąć zdjęcia z elektronicznego raportu
- Przy format=jpeg starać się nie przekodowywać strumieni JPEG
- Wziąć same obrazy bez rasteryzacji całych stron
Jak wyodrębnić obrazy z PDF?
- Prześlij PDF z osadzonymi zdjęciami lub rastrami.
- Zostaw PNG albo wybierz JPEG.
- Kliknij Przetwórz i pobierz `{name}_extracted_images.zip`.
- Jeśli w ZIP nie ma użytecznych plików, PDF nie ma dekodowalnych obrazów XObject.
Ograniczenia i przypadki brzegowe
- To nie narzędzie renderujące strony
- LZW kończy zadanie błędem
- Wyjściowy PNG jest w RGB, więc przezroczystość i miękkie maski są odrzucane
- Bez OCR
- Limit przesyłania na tej stronie: 500 MB na plik, wysyłane porcjami powyżej około 95 MB. Treść pojedynczego bezpośredniego żądania API jest ograniczona do 100 MB.
Przykłady
- PDF z trzema unikalnymi XObject zdjęć daje w ZIP image_1 do image_3
- Strona z logo wektorowym może nic nie wnieść
Prywatność tego narzędzia
Pliki są przesyłane przez HTTPS, przetwarzane w pamięci lub w krótkotrwałym katalogu tymczasowym na naszych serwerach i usuwane, gdy wynik jest gotowy. Nie przechowujemy kopii do późniejszego przeglądania, trenowania ani profili reklamowych. Szczegóły retencji i pliki cookie AdSense znajdują się w polityce prywatności.
Najczęstsze pytania
- Dlaczego nie ma po jednym obrazie na stronę?
- Wyciągane są tylko osadzone obrazy XObject. Strona z tekstem i wektorami może nie dać nic.
- Czym różni się od PDF na obrazy?
- PDF na obrazy renderuje strony. Wyodrębnij obrazy wyjmuje obiekty obrazów już w pliku.
- A LZW?
- Dekodowanie LZW nie jest zaimplementowane. Zadanie kończy się błędem, nie pomija jednego obrazu.
- Czy maski i SMask są obsługiwane?
- Traktuj wynik jako eksport pikseli na tyle, na ile się da. Miękkie maski i rzadsze przestrzenie kolorów mogą wyjść źle.
Ostatnia aktualizacja:
Wywołanie z kodu
Każde narzędzie na stronie to zwykły interfejs REST. Anonimowo nie trzeba konta ani klucza API. Działa w przeglądarce, u programistów i u agentów AI.
curl -X POST "https://pdf123.xyz/api/v1/misc/extract-images" \
-F "[email protected]" \
-F "format=png" \
-o output.pdfDostępne też jako narzędzie MCP dla klientów mówiących Model Context Protocol (JSON-RPC 2.0, POST /mcp). Pełna dokumentacja API
Użyj go z agentem AI
SkillZ tym skillem Claude Code, Codex, Cursor i inne agenty AI mogą wykonać za Ciebie „Wyodrębnij obrazy”: /skills/pdf123-extract-images.md
Pliki służą tylko do tego zadania i są potem automatycznie usuwane.