Unire PDF senza appiattire tutto in immagini
Un merge PDF corretto concatena gli stream: font, vettori e segnalibri restano intatti. Rasterizzare ogni pagina in un'immagine è un lavoro diverso e più lossy.

«Unisci questi cinque PDF» può significare due pipeline diverse. Una concatena gli oggetti pagina esistenti in un unico file. L'altra stampa ogni pagina in una bitmap e impacchetta le immagini in un nuovo PDF. Entrambe producono un solo allegato. Solo la prima conserva testo selezionabile e vettori nitidi.
Cosa fa un merge strutturale
Su PDF123, Unisci combina due o più PDF unendo gli oggetti pagina di ciascun file. Il percorso sul server esegue qpdf con base vuota e --pages sugli input: gli stream di pagina si spostano come pagine, non come screenshot. Font incorporati, vettori e segnalibri esistenti viaggiano con quelle pagine. Nulla in quel percorso rasterizza una pagina in un'immagine, quindi un contratto nativo digitale resta ricercabile e copiabile dopo l'unione.
Per impostazione predefinita l'ordine di caricamento è l'ordine di output. Il modulo HTTP accetta più parti fileInput ripetute in una sola richiesta; la dimensione del lotto è limitata dai limiti di caricamento, non da un tetto rigido di due file. L'opzione sortType=byFileName riordina gli input per nome file prima dell'unione. I segnalibri di ciascuna sorgente possono sopravvivere; un merge non inventa un albero di outline perfetto se gli input non ne avevano uno.
Il caricamento di un singolo file è un passaggio senza modifiche di quel PDF. Due o più file diventano un unico merged.pdf le cui pagine sono la concatenazione degli input nell'ordine scelto. Lo stesso id di operazione è quello esposto da OpenAPI, MCP e pdfx merge, quindi uno script e un clic nel browser non divergono di nascosto su cosa significhi «merge».
Quando si rasterizza senza volerlo
Alcuni flussi di «combinazione» esportano prima in immagini (gateway fax, app di scansione, stampa in PDF a risoluzione schermo) oppure appiattiscono le annotazioni in bitmap prima di unire. La dimensione del file schizza, può servire di nuovo l'OCR e lo zoom mostra i bordi dei pixel.
Preferisci un merge a stream quando le sorgenti sono già PDF digitali. Ricorri a OCR solo quando gli input sono scansioni senza testo utilizzabile, e ricorda che qui l'OCR restituisce Markdown (text/markdown), non un PDF con uno strato di testo nascosto. Rasterizzare e poi applicare l'OCR è un percorso di prodotto diverso dall'unire file nativi digitali.
Se ti servono immagini delle pagine, quello è un lavoro di conversione (PDF in immagini), non un merge. Mescolare questi intenti è il modo in cui i file «uniti» diventano album fotografici di documenti da diversi megabyte. Comprimere dopo un merge strutturale può ancora ridurre gli stream (Comprimi); non annulla un appiattimento raster che hai già introdotto.
Cosa merge non promette
Merge non normalizza le dimensioni delle pagine, non unifica i font tra file diversi e non ricostruisce un indice da zero. Non decifra al posto tuo gli input cifrati: sbloccali prima se la sorgente è protetta da password. Non sostituisce un formato portfolio o package che alcuni portali giudiziari si aspettano; produce un normale PDF a più pagine.
Questi limiti valgono sia che tu usi il browser, sia REST, MCP o pdfx. L'operazione è volutamente ristretta, perché l'output resti prevedibile per l'automazione. Se ti serve un lavoro ordinato in più passaggi (unire, poi applicare una filigrana, poi comprimere), usa POST /api/v1/pipeline con una lista ordinata steps, invece di inventare un secondo flag di «smart merge».
Come eseguirlo
Unire PDF nel browser, oppure POST /api/v1/general/merge-pdfs con parti fileInput ripetute (Developers). Da una shell:
pdfx merge a.pdf b.pdf -o merged.pdf
Oppure contro una base ospitata o self-hosted:
pdfx --cloud --api-base "$API_BASE" --api-key "$KEY" merge a.pdf b.pdf -o merged.pdf
Le chiamate anonime al catalogo non richiedono chiave sul sito pubblico; le chiavi servono per un'identità di automazione stabile e per i server self-hosted protetti. Per la stessa operazione anche via curl e MCP, vedi La stessa operazione, quattro client.