Fusionner des PDF sans tout aplatir en images
La fusion PDF concatène les flux de pages : polices, vecteurs et signets restent intacts. Rasteriser les pages en images est une autre tâche, plus destructrice.

« Fusionner ces cinq PDF » peut désigner deux chaînes de traitement. L’une concatène les objets de page existants dans un seul fichier. L’autre imprime chaque page en image matricielle et empaquette ces images dans un nouveau PDF. Les deux produisent une pièce jointe unique. Seule la première conserve un texte sélectionnable et des vecteurs nets.
Ce que fait une fusion structurelle
Sur PDF123, Fusionner combine deux PDF ou plus en joignant les objets de page de chaque fichier. Le chemin serveur lance qpdf avec une base vide et --pages sur les entrées : les flux de pages se déplacent en tant que pages, pas en tant que captures d’écran. Les polices intégrées, les vecteurs et les signets existants suivent ces pages. Rien dans ce chemin ne rasterise une page, si bien qu’un contrat né numérique reste interrogeable et copiable après la jointure.
L’ordre de téléversement est l’ordre de sortie par défaut. Le formulaire HTTP accepte des parties fileInput répétées dans une même requête ; la taille du lot est bornée par les limites de téléversement, pas par un plafond strict de deux fichiers. L’option sortType=byFileName réordonne les entrées par nom de fichier avant la jointure. Les signets de chaque source peuvent survivre ; une fusion ne crée pas un plan parfait si les entrées n’en avaient aucun.
Un téléversement d’un seul fichier renvoie ce PDF sans modification. Deux fichiers ou plus donnent un merged.pdf dont les pages sont la concaténation des entrées dans l’ordre choisi. C’est le même identifiant d’opération qu’exposent OpenAPI, MCP et pdfx merge : un script et un clic dans le navigateur ne divergent donc pas en silence sur ce que signifie « fusionner ».
Quand on rasterise sans le vouloir
Certaines chaînes « combiner » exportent d’abord en images (passerelles de fax, applications de numérisation, impression vers PDF à la résolution de l’écran) ou aplatissent les annotations en images matricielles avant la jointure. La taille du fichier bondit, l’OCR peut redevenir nécessaire et le zoom révèle des bords de pixels.
Préférez une fusion de flux quand les sources sont déjà des PDF numériques. Réservez OCR aux entrées qui sont des scans sans texte exploitable, et rappelez-vous que l’OCR renvoie ici du Markdown (text/markdown), pas un PDF pourvu d’une nouvelle couche de texte cachée. Rasteriser puis lancer l’OCR est une autre voie que fusionner des fichiers nés numériques.
Si vous avez besoin d’images de pages, c’est une tâche de conversion (PDF vers images), pas une fusion. Mélanger les deux intentions transforme les fichiers « fusionnés » en albums photo de plusieurs mégaoctets. Une compression après une fusion structurelle peut encore réduire les flux (Compresser) ; elle n’annule pas un aplatissement en images déjà effectué.
Ce que la fusion ne promet pas
La fusion ne normalise pas les formats de page, n’unifie pas les polices entre fichiers et ne reconstruit pas une table des matières de zéro. Elle ne déchiffre pas les entrées chiffrées à votre place : déverrouillez d’abord si la source est protégée par mot de passe. Elle ne remplace pas un format de conteneur de type portfolio que certains portails judiciaires attendent ; elle produit un PDF ordinaire de plusieurs pages.
Ces limites sont les mêmes que vous passiez par le navigateur, REST, MCP ou pdfx. L’opération est volontairement étroite, pour que la sortie reste prévisible en automatisation. Pour un enchaînement ordonné (fusionner, puis filigrane, puis compresser), utilisez POST /api/v1/pipeline avec une liste ordonnée steps, plutôt que d’inventer une seconde option de « fusion intelligente ».
Comment l’exécuter
Fusionner des PDF dans le navigateur, ou appelez POST /api/v1/general/merge-pdfs avec des parties fileInput répétées (Développeurs). Depuis un shell :
pdfx merge a.pdf b.pdf -o merged.pdf
Ou contre une base hébergée ou auto-hébergée :
pdfx --cloud --api-base "$API_BASE" --api-key "$KEY" merge a.pdf b.pdf -o merged.pdf
Les appels anonymes du catalogue n’exigent aucune clé sur le site public ; les clés servent à une identité d’automatisation stable et aux serveurs auto-hébergés protégés. Pour la même opération via curl et MCP également, voir Une même opération, quatre clients.