PDFs zusammenführen, ohne alles in Bilder umzuwandeln
Ein echtes Zusammenführen verkettet Seitenstreams: Schriften, Vektoren und Lesezeichen bleiben intakt. Rasterisierung ist ein anderer, verlustreicherer Vorgang.

„Diese fünf PDFs zusammenführen“ kann zwei verschiedene Abläufe meinen. Der eine verkettet vorhandene Seitenobjekte zu einer Datei. Der andere druckt jede Seite in eine Bitmap und packt die Bilder in eine neue PDF. Beide erzeugen einen Anhang. Nur der erste behält markierbaren Text und scharfe Vektoren.
Was ein strukturelles Zusammenführen leistet
Auf PDF123 verbindet Zusammenführen zwei oder mehr PDFs, indem es die Seitenobjekte jeder Datei aneinanderfügt. Der Pfad auf dem Server ruft qpdf mit leerer Basis und --pages über die Eingaben auf: Seitenstreams werden als Seiten verschoben und nicht als Bildschirmaufnahmen. Eingebettete Schriften, Vektoren und vorhandene Lesezeichen wandern mit diesen Seiten. Nichts in diesem Pfad wandelt eine Seite in ein Bild um, sodass ein digital erzeugter Vertrag nach dem Zusammenfügen weiterhin durchsucht und kopiert werden kann.
Die Reihenfolge des Uploads ist standardmäßig die Reihenfolge in der Ausgabe. Das HTTP-Formular nimmt wiederholte Teile fileInput in einer Anfrage entgegen; die Stapelgröße richtet sich nach den Upload-Grenzen und nicht nach einer festen Obergrenze von zwei Dateien. Das optionale sortType=byFileName ordnet die Eingaben vor dem Zusammenfügen nach Dateinamen. Lesezeichen der einzelnen Quellen können erhalten bleiben; ein Zusammenführen erfindet keinen perfekten Gliederungsbaum, wenn die Eingaben nie einen hatten.
Ein Upload mit einer einzelnen Datei ist ein Durchlauf ohne Veränderung. Zwei oder mehr Dateien werden zu einer merged.pdf, deren Seiten die Verkettung der Eingaben in der gewählten Reihenfolge sind. Dieselbe Kennung der Operation geben OpenAPI, MCP und pdfx merge aus, damit sich ein Skript und ein Klick im Browser nicht stillschweigend uneinig sind, was „merge“ bedeutet.
Wann versehentlich rasterisiert wird
Manche Abläufe zum „Kombinieren“ exportieren zuerst in Bilder (Fax-Gateways, Scan-Anwendungen, Druck in eine PDF in Bildschirmauflösung) oder wandeln Anmerkungen vor dem Zusammenfügen in Bitmaps um. Die Dateigröße springt, OCR kann erneut nötig werden, und beim Zoomen sind Pixelkanten zu sehen.
Ziehe das Zusammenführen von Streams vor, wenn die Quellen bereits digitale PDFs sind. Ziehe OCR nur dann vor, wenn die Eingaben Scans ohne brauchbaren Text sind, und denke daran, dass OCR hier Markdown (text/markdown) liefert und keine neu geschichtete PDF mit verborgener Textebene. Erst zu rasterisieren und dann OCR auszuführen ist ein anderer Produktweg als das Zusammenführen digital erzeugter Dateien.
Wenn du Bilder von Seiten brauchst, ist das eine Konvertierung (PDF zu Bildern) und kein Zusammenführen. Wer diese Absichten vermischt, erhält aus „zusammengeführten“ Dateien mehrere Megabyte große Fotoalben von Dokumenten. Komprimieren nach einem strukturellen Zusammenführen kann Streams noch verkleinern (Komprimieren); es macht eine bereits eingebackene Rasterung nicht rückgängig.
Was das Zusammenführen nicht verspricht
Das Zusammenführen vereinheitlicht keine Seitenformate, führt Schriften aus verschiedenen Dateien nicht zusammen und baut kein Inhaltsverzeichnis von Grund auf neu. Es entschlüsselt verschlüsselte Eingaben nicht für dich; entsperre zuerst, wenn die Quelle mit einem Passwort geschützt ist. Es ersetzt kein Containerformat für Portfolios oder Pakete, das manche Gerichtsportale erwarten; es erzeugt eine gewöhnliche mehrseitige PDF.
Diese Grenzen gelten gleichermaßen für Browser, REST, MCP und pdfx. Die Operation ist bewusst eng gefasst, damit die Ausgabe für die Automatisierung vorhersagbar bleibt. Brauchst du geordnete Arbeit in mehreren Schritten (zusammenführen, dann Wasserzeichen, dann komprimieren), nutze POST /api/v1/pipeline mit einer geordneten Liste steps, statt einen zweiten Schalter für ein „intelligentes Zusammenführen“ zu erfinden.
So führst du es aus
PDFs zusammenführen im Browser oder POST /api/v1/general/merge-pdfs mit wiederholten Teilen fileInput (Entwickler). Aus einer Shell:
pdfx merge a.pdf b.pdf -o merged.pdf
Oder gegen eine gehostete oder selbst gehostete Basis:
pdfx --cloud --api-base "$API_BASE" --api-key "$KEY" merge a.pdf b.pdf -o merged.pdf
Anonyme Aufrufe des Katalogs brauchen auf der öffentlichen Website keinen Schlüssel; Schlüssel zählen für eine stabile Identität in der Automatisierung und für abgeschottete selbst gehostete Server. Dieselbe Operation auch über curl und MCP zeigt Dieselbe Operation, vier Clients.