PDF omzetten naar XML
PDF naar XML importeert een PDF via LibreOffice en geeft een XML-bestand in Office-stijl terug. Het is een tekst- en lay-outexport naar beste vermogen, geen kopie van de structuur of tags van de PDF.
Sleep bestanden hierheen, of klik om te kiezen
Accepteert PDF · tot 500.0 MB per bestand · maximaal 20 bestanden tegelijk
Je kunt een bestand ook plakken met Ctrl/Cmd+V of via het klembordmenu.
PDF naar XML stuurt het bestand naar LibreOffice `writer_pdf_import` met `outputFormat=xml`. De download is Office-achtige XML (`octet-stream`), geen reconstructie van PDF-content streams of tagged-PDF-structuur.
Dit is dezelfde LibreOffice-importfamilie als PDF naar Word, met XML als doel. Lay-out, tabellen en lettertypen zijn zonder garantie. Scans zonder tekstlaag worden beelden of lege alinea’s.
Deze pagina heeft geen opties. Wachtwoordbeveiligde bestanden worden op deze pagina voor u ontgrendeld zodra u het wachtwoord invoert; API-gebruikers voeren eerst Wachtwoord verwijderen uit. OCR-Markdown kan hier niet naartoe.
Rijen uit tabellen: PDF naar CSV. Alleen woorden: PDF naar RTF.
Uploads zijn tijdelijk. Wij bewaren geen XML-bibliotheek.
Functies
- LibreOffice `writer_pdf_import` naar XML
- Geen PDF-structuurexport, geen OCR
- Geen paginabereik- of schema-opties
- Anonieme API: /api/v1/convert/pdf/xml
Wanneer je dit gebruikt
- Elektronische PDF aan een pijplijn die Office-XML al accepteert
- Zien hoe LibreOffice het document knipt
- Een XML-concept wanneer de volgende stap geen DOCX is
Hoe zet ik een PDF om naar XML?
- Voeg een tekstgebaseerde PDF toe.
- Klik op Verwerken. Deze pagina heeft geen formaatopties.
- Haal het ` op.xml`-bestand.
- Open in LibreOffice of een editor en behandel het als concept.
Beperkingen en randgevallen
- Geen tagged-PDF, geen XFDF/XFA-extractie
- Geen OCR
- Tabellen en paginering komen niet overeen met de PDF
- Uploadlimiet op deze website: 500 MB per bestand, in delen verzonden boven ongeveer 95 MB. Eén directe API-aanvraag is beperkt tot 100 MB.
Voorbeelden
- Een tekstmemo wordt vaak grote Office-XML met alinea-runs
- Een pure scan-PDF wordt vaak XML die vooral beelden omvat
Privacy bij deze tool
Bestanden worden via HTTPS geüpload, in het geheugen of in een kortlevende tijdelijke map op onze servers verwerkt, en verwijderd zodra uw resultaat klaar is. Wij bewaren geen kopieën voor later bladeren, training of advertentieprofielen. Zie het privacybeleid voor bewaartermijnen en AdSense-cookiemeldingen.
Veelgestelde vragen
- Is dit XML uit de PDF zelf?
- Nee. LibreOffice exporteert het geïmporteerde document als XML — niet de PDF-objectboom.
- Waarom is een scan bijna leeg?
- LibreOffice heeft geen tekst om te importeren. Voor woorden in pixels: OCR naar Markdown.
- Kan ik een ander XML-dialect kiezen?
- Nee. Dit pad zet outputFormat vast op xml en staat alleen die waarde toe.
- Wat is het verschil met PDF naar Word?
- Zelfde importer, andere uitvoer. PDF naar Word geeft docx, doc of odt. Dit pad geeft xml.
Laatst bijgewerkt:
Aanroepen vanuit code
Elke tool op deze site is een gewoon REST-eindpunt. Voor anoniem gebruik heb je geen account of API-sleutel nodig. Net zo goed voor AI-agenten en ontwikkelaars als voor de browser.
curl -X POST "https://pdf123.xyz/api/v1/convert/pdf/xml" \
-F "[email protected]" \
-o output.pdfOok beschikbaar als MCP-tool voor clients die Model Context Protocol spreken (JSON-RPC 2.0 via POST /mcp). Volledige API-documentatie
Gebruik het vanuit een AI-agent
SkillMet deze skill kunnen Claude Code, Codex, Cursor en andere AI-agents ‘PDF naar XML’ voor je uitvoeren: /skills/pdf123-pdf-to-xml.md
Bestanden dienen alleen voor deze verwerking en worden daarna automatisch verwijderd.