PDF in XML konvertieren
PDF in XML importiert eine PDF über LibreOffice und liefert eine XML-Datei im Office-Stil. Es ist ein Text- und Layout-Export nach bestem Können, keine Kopie von Struktur oder Tags der PDF.
Dateien hierher ziehen oder klicken, um auszuwählen
Akzeptiert PDF · bis zu 500.0 MB pro Datei · bis zu 20 Dateien auf einmal
Sie können eine Datei auch mit Strg/Cmd+V oder über das Zwischenablage-Menü einfügen.
PDF in XML schickt die Datei durch LibreOffice `writer_pdf_import` mit `outputFormat=xml`. Der Download ist Office-artiges XML (`octet-stream`), keine Rekonstruktion von PDF-Inhaltsströmen oder tagged-PDF-Struktur.
Das ist dieselbe LibreOffice-Importfamilie wie PDF in Word, nur mit Ziel XML. Layout, Tabellen und Schriften werden mit begrenzter Treue neu aufgebaut. Scans ohne Textschicht werden zu Bildern oder leeren Absätzen.
Auf dieser Seite gibt es keine Optionen. Passwortgeschützte Dateien werden auf dieser Seite für Sie entsperrt, sobald Sie das Passwort eingeben; API-Aufrufer führen zuerst «Passwort entfernen» aus. OCR-Markdown gehört nicht hierher.
Zeilen aus Tabellen: PDF in CSV. Nur Wörter: PDF in RTF.
Uploads sind temporär. Wir führen keine XML-Bibliothek.
Funktionen
- LibreOffice `writer_pdf_import` nach XML
- Kein PDF-Strukturexport und kein OCR
- Kein Seitenbereich und keine Schema-Option
- Anonyme API: /api/v1/convert/pdf/xml
Wann Sie dieses Werkzeug nutzen
- Digitale PDFs an Pipelines geben, die schon Office-XML annehmen
- Sehen, wie LibreOffice das Dokument schneidet
- XML-Entwurf holen, wenn der nächste Schritt kein DOCX ist
Wie wandle ich eine PDF in XML um?
- PDF mit Text hochladen.
- Verarbeiten. Keine Formatoptionen auf dieser Seite.
- `.xml` herunterladen.
- In LibreOffice oder einem Editor öffnen und als Entwurf behandeln.
Grenzen und Sonderfälle
- Kein tagged-PDF und kein XFDF/XFA-Extrakt
- Kein OCR
- Tabellen und Seitenumbrüche stimmen nicht mit der PDF überein
- Upload-Limit auf dieser Website: 500 MB pro Datei, ab etwa 95 MB in Teilstücken gesendet. Eine einzelne direkte API-Anfrage ist auf 100 MB begrenzt.
Beispiele
- Textmemos werden oft zu großem Office-XML mit Absatz-Runs
- Reine Scan-PDFs werden oft zu XML, das vor allem Bilder einpackt
Datenschutz für dieses Werkzeug
Dateien werden über HTTPS hochgeladen, im Speicher oder in einem kurzlebigen temporären Verzeichnis auf unseren Servern verarbeitet und gelöscht, sobald Ihr Ergebnis bereitsteht. Wir behalten keine Kopien für späteres Durchsuchen, Training oder Werbeprofile. Einzelheiten zur Speicherdauer und zu AdSense-Cookies stehen in der Datenschutzerklärung.
Häufige Fragen
- Ist das internes PDF-XML?
- Nein. LibreOffice exportiert das importierte Dokument als XML — kein PDF-Objektbaum.
- Warum sind Scans fast leer?
- LibreOffice hat keinen Text zum Import. Wörter in Pixeln: OCR nach Markdown.
- Andere XML-Dialekte wählbar?
- Nein. Dieser Pfad setzt outputFormat fest auf xml und erlaubt nur diesen Wert.
- Unterschied zu PDF in Word?
- Gleicher Importer, andere Ausgabe. PDF in Word liefert docx/doc/odt. Dieser Pfad liefert xml.
Zuletzt aktualisiert:
Per Code aufrufen
Jedes Werkzeug auf dieser Seite ist ein gewöhnlicher REST-Endpunkt. Für anonyme Nutzung brauchen Sie weder Konto noch API-Schlüssel. Für Browser, Entwickler und KI-Agenten gleichermaßen.
curl -X POST "https://pdf123.xyz/api/v1/convert/pdf/xml" \
-F "[email protected]" \
-o output.pdfAuch als MCP-Werkzeug für Clients, die Model Context Protocol sprechen (JSON-RPC 2.0 über POST /mcp). Vollständige API-Referenz
Mit einem KI-Agenten nutzen
SkillMit diesem Skill können Claude Code, Codex, Cursor und andere KI-Agenten „PDF in XML“ für Sie ausführen: /skills/pdf123-pdf-to-xml.md
Dateien dienen nur diesem Auftrag und werden danach automatisch gelöscht.