PDF in HTML konvertieren
PDF in HTML wandelt eine PDF mit Popplers pdftohtml um und liefert ein ZIP mit den HTML-Seiten und ihren Bildern. Es ist ein Layout-Export und kein sauberes Web-Markup, und es nutzt kein OCR.
Dateien hierher ziehen oder klicken, um auszuwählen
Akzeptiert PDF · bis zu 500.0 MB pro Datei · bis zu 20 Dateien auf einmal
Sie können eine Datei auch mit Strg/Cmd+V oder über das Zwischenablage-Menü einfügen.
PDF in HTML führt Poppler `pdftohtml -c` aus und zippt, was das Werkzeug ins Ausgabeverzeichnis schreibt. Der Download heißt `{base}ToHtml.zip`, keine einzelne `.html`. Ziel ist nicht Browser-CSS, sondern Popplers HTML- und Bildexport.
Auf dieser Seite gibt es keine Formularfelder. Jede Seite wird konvertiert. Schreibt `pdftohtml` nichts, liefert die API einen internen Fehler, kein leeres ZIP.
Das ist kein OCR. Reine Bildscans werden zu Bildern im HTML-Paket, nicht zu auswählbarem Text. Passwortgeschützte Dateien werden auf dieser Seite für Sie entsperrt, sobald Sie das Passwort eingeben; API-Aufrufer führen zuerst «Passwort entfernen» aus.
Nur Text: PDF in RTF. CMS-taugliche Artikel: PDF in Markdown.
Uploads sind temporär. Wir führen keine HTML-Bibliothek.
Funktionen
- Poppler `pdftohtml -c`, Ausgabe ZIP aus HTML und Ressourcen
- Kein Seitenbereich und keine Themenoption
- Kein OCR; Scans bleiben Bilder im Paket
- Anonyme API: /api/v1/convert/pdf/html
Wann Sie dieses Werkzeug nutzen
- Grobes HTML aus einer PDF mit Textschicht holen
- Von pdftohtml extrahierte Seitenbilder mitnehmen
- Vor einer Eigenpipeline sehen, wie Poppler die Datei versteht
Wie wandle ich eine PDF in HTML um?
- Laden Sie ein PDF hoch. Keine Konvertierungsoptionen auf dieser Seite.
- Klicken Sie auf Verarbeiten und laden Sie `{name}ToHtml.zip` herunter.
- Entpacken und HTML im Browser öffnen.
- Prüfen Sie Bilder und Text. Scans werden nicht zu echtem HTML-Text.
Grenzen und Sonderfälle
- Ausgabe ist ZIP, kein einzelnes HTML
- Kein Chromium-Druck und kein tagged-PDF-HTML-Export
- Leere pdftohtml-Ausgabe ist Fehler, kein 204
- Upload-Limit auf dieser Website: 500 MB pro Datei, ab etwa 95 MB in Teilstücken gesendet. Eine einzelne direkte API-Anfrage ist auf 100 MB begrenzt.
Beispiele
- Einfache Textmemos entpacken oft zu einem HTML plus einigen Bildern
- Reine Scan-PDFs liefern HTML, das vor allem Seitenbilder einpackt
Datenschutz für dieses Werkzeug
Dateien werden über HTTPS hochgeladen, im Speicher oder in einem kurzlebigen temporären Verzeichnis auf unseren Servern verarbeitet und gelöscht, sobald Ihr Ergebnis bereitsteht. Wir behalten keine Kopien für späteres Durchsuchen, Training oder Werbeprofile. Einzelheiten zur Speicherdauer und zu AdSense-Cookies stehen in der Datenschutzerklärung.
Häufige Fragen
- Warum ZIP?
- pdftohtml schreibt HTML plus extrahierte Bilder in einen Ordner. Der Server packt diesen Ordner.
- Stimmt das HTML mit dem PDF-Layout überein?
- Nur soweit Poppler-`-c`-Modus reicht. Mehrspaltige Magazine und viel Vektor passen oft nicht.
- Können Scans zu HTML-Text werden?
- Nein. Dieser Pfad macht kein OCR. Für Text: OCR nach Markdown.
- Läuft das im Browser?
- Nein. Der Server ruft pdftohtml auf.
Zuletzt aktualisiert:
Per Code aufrufen
Jedes Werkzeug auf dieser Seite ist ein gewöhnlicher REST-Endpunkt. Für anonyme Nutzung brauchen Sie weder Konto noch API-Schlüssel. Für Browser, Entwickler und KI-Agenten gleichermaßen.
curl -X POST "https://pdf123.xyz/api/v1/convert/pdf/html" \
-F "[email protected]" \
-o output.pdfAuch als MCP-Werkzeug für Clients, die Model Context Protocol sprechen (JSON-RPC 2.0 über POST /mcp). Vollständige API-Referenz
Mit einem KI-Agenten nutzen
SkillMit diesem Skill können Claude Code, Codex, Cursor und andere KI-Agenten „PDF in HTML“ für Sie ausführen: /skills/pdf123-pdf-to-html.md
Dateien dienen nur diesem Auftrag und werden danach automatisch gelöscht.