Product2026-09-083 min czytania

Łączenie PDF bez spłaszczania wszystkiego do obrazów

Właściwe scalanie PDF łączy strumienie stron: fonty, wektory i zakładki zostają nienaruszone. Rasteryzacja każdej strony do obrazów to inne, stratniejsze zadanie.

PDF123 · Updated 2026-09-29

„Scal te pięć PDF-ów” może oznaczać dwa różne potoki. Jeden łączy istniejące obiekty stron w jeden plik. Drugi drukuje każdą stronę do bitmapy i pakuje obrazy w nowy PDF. Oba dają jeden załącznik. Tylko pierwszy zachowuje zaznaczalny tekst i ostre wektory.

Co robi scalanie strukturalne

W PDF123 Scal PDF łączy dwa lub więcej plików PDF, dołączając obiekty stron każdego z nich. Ścieżka serwera uruchamia qpdf z pustą bazą i opcją --pages na wejściach: strumienie stron przenoszą się jako strony, a nie jako zrzuty ekranu. Osadzone fonty, wektory i istniejące zakładki wędrują razem ze stronami. Nic w tej ścieżce nie rasteryzuje strony do obrazu, więc cyfrowa umowa nadal daje się przeszukiwać i kopiować po scaleniu.

Kolejność przesyłania jest domyślnie kolejnością wyjściową. Formularz HTTP przyjmuje powtarzane części fileInput w jednym żądaniu, a rozmiar partii ograniczają limity przesyłania, nie sztywny limit dwóch plików. Opcjonalny parametr sortType=byFileName porządkuje wejścia według nazwy pliku przed scaleniem. Zakładki z poszczególnych źródeł mogą przetrwać; scalanie nie wymyśli jednak idealnego drzewa spisu, jeśli wejścia go nie miały.

Przesłanie jednego pliku to przepuszczenie go bez zmian. Dwa lub więcej plików staje się jednym merged.pdf, którego strony są konkatenacją wejść w wybranej kolejności. Ten sam identyfikator operacji wystawiają OpenAPI, MCP i pdfx merge, więc skrypt i kliknięcie w przeglądarce nie rozjeżdżają się po cichu w rozumieniu „scalania”.

Kiedy ludzie przypadkiem rasteryzują

Niektóre procesy „łączenia” najpierw eksportują strony do obrazów (bramki faksowe, aplikacje skanujące, druk do PDF w rozdzielczości ekranu) albo spłaszczają adnotacje do bitmap przed połączeniem. Rozmiar pliku skacze, OCR może być znowu potrzebny, a przy powiększeniu widać krawędzie pikseli.

Gdy źródła to już cyfrowe PDF-y, wybierz scalanie strumieni. Po OCR sięgaj tylko wtedy, gdy wejścia to skany bez użytecznego tekstu, i pamiętaj, że OCR w tym serwisie zwraca Markdown (text/markdown), a nie PDF z dopisaną ukrytą warstwą tekstu. Rasteryzacja, a potem OCR to inna ścieżka produktu niż scalanie plików cyfrowych.

Jeśli potrzebujesz obrazów stron, to zadanie konwersji (PDF na obrazy), a nie scalania. Mieszanie tych intencji sprawia, że „połączone” pliki stają się wielomegabajtowymi albumami zdjęć dokumentów. Kompresja po scaleniu strukturalnym nadal może zmniejszyć strumienie (Compress), ale nie cofnie rasteryzacji, którą już wprowadziłeś.

Czego scalanie nie obiecuje

Scalanie nie normalizuje rozmiarów stron, nie ujednolica fontów między plikami ani nie odbudowuje spisu treści od zera. Nie odszyfrowuje za ciebie zaszyfrowanych wejść; jeśli źródło jest chronione hasłem, najpierw je odblokuj. Nie zastępuje formatu teczki czy pakietu, którego oczekują niektóre portale sądowe; tworzy zwykły wielostronicowy PDF.

Te ograniczenia są takie same niezależnie od tego, czy używasz przeglądarki, REST, MCP czy pdfx. Operacja jest celowo wąska, aby wynik pozostawał przewidywalny dla automatyzacji. Jeśli potrzebujesz uporządkowanej pracy wieloetapowej (scal, potem znak wodny, potem kompresja), użyj POST /api/v1/pipeline z uporządkowaną listą steps zamiast wymyślać drugą flagę „inteligentnego scalania”.

Jak to uruchomić

Scal PDF-y w przeglądarce albo wywołaj POST /api/v1/general/merge-pdfs z powtarzanymi częściami fileInput (Dla programistów). Z powłoki:

pdfx merge a.pdf b.pdf -o merged.pdf

Albo wskaż jawnie adres bazowy i klucz, dla serwera self-hosted albo innego:

pdfx --api-base "$API_BASE" --api-key "$KEY" merge a.pdf b.pdf -o merged.pdf

Anonimowe wywołania katalogu nie wymagają klucza w publicznym serwisie; klucze mają znaczenie dla stabilnej tożsamości automatyzacji oraz dla zamkniętych serwerów self-hosted. Tę samą operację przez curl i MCP opisuje Ta sama operacja, cztery klienty.

Open tool
Process in the browser — no watermark, files removed after the job.
Open tool