Naar de hoofdinhoud
PPDF123

PDF omzetten naar XML

PDF naar XML importeert een PDF via LibreOffice en geeft een XML-bestand in Office-stijl terug. Het is een tekst- en lay-outexport naar beste vermogen, geen kopie van de structuur of tags van de PDF.

Sleep bestanden hierheen, of klik om te kiezen

Accepteert PDF · tot 500.0 MB per bestand · maximaal 20 bestanden tegelijk

Je kunt een bestand ook plakken met Ctrl/Cmd+V of via het klembordmenu.

PDF naar XML stuurt het bestand naar LibreOffice `writer_pdf_import` met `outputFormat=xml`. De download is Office-achtige XML (`octet-stream`), geen reconstructie van PDF-content streams of tagged-PDF-structuur.

Dit is dezelfde LibreOffice-importfamilie als PDF naar Word, met XML als doel. Lay-out, tabellen en lettertypen zijn zonder garantie. Scans zonder tekstlaag worden beelden of lege alinea’s.

Deze pagina heeft geen opties. Wachtwoordbeveiligde bestanden worden op deze pagina voor u ontgrendeld zodra u het wachtwoord invoert; API-gebruikers voeren eerst Wachtwoord verwijderen uit. OCR-Markdown kan hier niet naartoe.

Rijen uit tabellen: PDF naar CSV. Alleen woorden: PDF naar RTF.

Uploads zijn tijdelijk. Wij bewaren geen XML-bibliotheek.

Functies

  • LibreOffice `writer_pdf_import` naar XML
  • Geen PDF-structuurexport, geen OCR
  • Geen paginabereik- of schema-opties
  • Anonieme API: /api/v1/convert/pdf/xml

Wanneer je dit gebruikt

  • Elektronische PDF aan een pijplijn die Office-XML al accepteert
  • Zien hoe LibreOffice het document knipt
  • Een XML-concept wanneer de volgende stap geen DOCX is

Hoe zet ik een PDF om naar XML?

  1. Voeg een tekstgebaseerde PDF toe.
  2. Klik op Verwerken. Deze pagina heeft geen formaatopties.
  3. Haal het ` op.xml`-bestand.
  4. Open in LibreOffice of een editor en behandel het als concept.

Beperkingen en randgevallen

  • Geen tagged-PDF, geen XFDF/XFA-extractie
  • Geen OCR
  • Tabellen en paginering komen niet overeen met de PDF
  • Uploadlimiet op deze website: 500 MB per bestand, in delen verzonden boven ongeveer 95 MB. Eén directe API-aanvraag is beperkt tot 100 MB.

Voorbeelden

  • Een tekstmemo wordt vaak grote Office-XML met alinea-runs
  • Een pure scan-PDF wordt vaak XML die vooral beelden omvat

Privacy bij deze tool

Bestanden worden via HTTPS geüpload, in het geheugen of in een kortlevende tijdelijke map op onze servers verwerkt, en verwijderd zodra uw resultaat klaar is. Wij bewaren geen kopieën voor later bladeren, training of advertentieprofielen. Zie het privacybeleid voor bewaartermijnen en AdSense-cookiemeldingen.

Veelgestelde vragen

Is dit XML uit de PDF zelf?
Nee. LibreOffice exporteert het geïmporteerde document als XML — niet de PDF-objectboom.
Waarom is een scan bijna leeg?
LibreOffice heeft geen tekst om te importeren. Voor woorden in pixels: OCR naar Markdown.
Kan ik een ander XML-dialect kiezen?
Nee. Dit pad zet outputFormat vast op xml en staat alleen die waarde toe.
Wat is het verschil met PDF naar Word?
Zelfde importer, andere uitvoer. PDF naar Word geeft docx, doc of odt. Dit pad geeft xml.

Laatst bijgewerkt:

Aanroepen vanuit code

Elke tool op deze site is een gewoon REST-eindpunt. Voor anoniem gebruik heb je geen account of API-sleutel nodig. Net zo goed voor AI-agenten en ontwikkelaars als voor de browser.

curl -X POST "https://pdf123.xyz/api/v1/convert/pdf/xml" \
  -F "[email protected]" \
  -o output.pdf

Ook beschikbaar als MCP-tool voor clients die Model Context Protocol spreken (JSON-RPC 2.0 via POST /mcp). Volledige API-documentatie

Gebruik het vanuit een AI-agent

Skill

Met deze skill kunnen Claude Code, Codex, Cursor en andere AI-agents ‘PDF naar XML’ voor je uitvoeren: /skills/pdf123-pdf-to-xml.md

Alle agent-skills

Bestanden dienen alleen voor deze verwerking en worden daarna automatisch verwijderd.