Naar de hoofdinhoud
PPDF123

PDF omzetten naar HTML

PDF naar HTML zet een PDF om met pdftohtml van Poppler en levert een ZIP met de HTML-pagina’s en hun afbeeldingen. Het is een lay-outdump in plaats van nette webmarkup en het doet geen OCR.

Sleep bestanden hierheen, of klik om te kiezen

Accepteert PDF · tot 500.0 MB per bestand · maximaal 20 bestanden tegelijk

Je kunt een bestand ook plakken met Ctrl/Cmd+V of via het klembordmenu.

PDF naar HTML draait Poppler `pdftohtml -c` en pakt wat dat gereedschap in de outputmap schrijft in een ZIP. De downloadnaam is `{base}ToHtml.zip`, geen enkel `.html`. Doel is Poppler’s HTML- en beeldexport, geen browser-niveau-CSS.

Deze pagina heeft geen formuliervelden. Elke pagina wordt geconverteerd. Schrijft `pdftohtml` niets, dan geeft de API een interne fout, geen lege ZIP.

Dit is geen OCR. Pure beeldscans worden beelden in het HTML-pakket, geen selecteerbare tekst. Wachtwoordbeveiligde bestanden worden op deze pagina voor u ontgrendeld zodra u het wachtwoord invoert; API-gebruikers voeren eerst Wachtwoord verwijderen uit.

Alleen tekst: PDF naar RTF. CMS-vriendelijke artikelen: PDF naar Markdown.

Uploads zijn tijdelijk. Wij bewaren geen HTML-bibliotheek.

Functies

  • Poppler `pdftohtml -c`, ZIP met HTML en assets
  • Geen paginabereik- of thema-opties
  • Geen OCR; scans blijven beelden in het pakket
  • Anonieme API: /api/v1/convert/pdf/html

Wanneer je dit gebruikt

  • Poppler-HTML voor snelle preview in de browser
  • PDF-assets naar een ZIP die een CMS kan hosten
  • Wanneer u Markdown-structuur niet nodig hebt

Hoe zet ik een PDF om naar HTML?

  1. Voeg een PDF toe. Deze pagina heeft geen conversie-opties.
  2. Klik op Verwerken en download `{name}ToHtml.zip`.
  3. Pak uit en open de HTML in een browser.
  4. Controleer beelden en tekst. Scans worden geen echte HTML-tekst.

Beperkingen en randgevallen

  • Geen paginabereik
  • Geen OCR
  • Lay-outgetrouwheid is beperkt
  • Uploadlimiet op deze website: 500 MB per bestand, in delen verzonden boven ongeveer 95 MB. Eén directe API-aanvraag is beperkt tot 100 MB.

Voorbeelden

  • Een tekstmemo wordt vaak een ZIP met HTML plus eventuele figuren
  • Een scan-PDF levert HTML die vooral op beelden wijst

Privacy bij deze tool

Bestanden worden via HTTPS geüpload, in het geheugen of in een kortlevende tijdelijke map op onze servers verwerkt, en verwijderd zodra uw resultaat klaar is. Wij bewaren geen kopieën voor later bladeren, training of advertentieprofielen. Zie het privacybeleid voor bewaartermijnen en AdSense-cookiemeldingen.

Veelgestelde vragen

Waarom is het resultaat een ZIP?
pdftohtml schrijft HTML plus geëxtraheerde beelden naar een map. De server pakt die map.
Komt de HTML overeen met de PDF-lay-out?
Alleen tot Poppler `-c`-modus. Meercolumnige magazines en veel vectoren komen vaak niet overeen.
Is dit OCR?
Nee. Beeldpagina’s blijven beelden in de export.
Kan ik één pagina exporteren?
Niet op dit pad. Haal eerst pagina’s eruit (of splits), converteer daarna dat stuk.

Laatst bijgewerkt:

Aanroepen vanuit code

Elke tool op deze site is een gewoon REST-eindpunt. Voor anoniem gebruik heb je geen account of API-sleutel nodig. Net zo goed voor AI-agenten en ontwikkelaars als voor de browser.

curl -X POST "https://pdf123.xyz/api/v1/convert/pdf/html" \
  -F "[email protected]" \
  -o output.pdf

Ook beschikbaar als MCP-tool voor clients die Model Context Protocol spreken (JSON-RPC 2.0 via POST /mcp). Volledige API-documentatie

Gebruik het vanuit een AI-agent

Skill

Met deze skill kunnen Claude Code, Codex, Cursor en andere AI-agents ‘PDF naar HTML’ voor je uitvoeren: /skills/pdf123-pdf-to-html.md

Alle agent-skills

Bestanden dienen alleen voor deze verwerking en worden daarna automatisch verwijderd.