Till huvudinnehållet
PPDF123

Konvertera PDF till HTML

PDF till HTML konverterar en PDF med Popplers pdftohtml och levererar en ZIP med HTML-sidorna och deras bilder. Det är en layoutdump snarare än ren webbmarkup, och den kör ingen OCR.

Dra filer hit, eller klicka för att välja

Tar emot PDF · upp till 500.0 MB per fil · upp till 20 filer åt gången

Du kan också klistra in en fil med Ctrl/Cmd+V eller via urklippsmenyn.

PDF till HTML kör Poppler `pdftohtml -c` och zippar det verktyget skriver till utdatakatalogen. Nedladdningsnamnet är `{base}ToHtml.zip`, inte en ensam `.html`. Målet är Popplers HTML- och bildexport, inte webbläsar-CSS.

Sidan har inga formulärfält. Varje sida konverteras. Om `pdftohtml` inte skriver något returnerar API:et internt fel, inte tom ZIP.

Det här är ingen OCR. Rena bildskanningar blir bilder i HTML-paketet, inte markerbar text. Lösenordsskyddade filer låses upp åt dig på den här sidan när du anger lösenordet; API-anropare kör Ta bort lösenord först.

Vill du bara ha text, använd PDF till RTF. Vill du ha CMS-vänlig artikeltext, använd PDF till Markdown.

Uppladdningar är tillfälliga. Vi sparar ingen HTML-katalog.

Funktioner

  • Poppler `pdftohtml -c`, ZIP med HTML och resurser
  • Inga sidintervall- eller temaalternativ
  • Ingen OCR; skanningar förblir bilder i paketet
  • Anonym API: /api/v1/convert/pdf/html

När du ska använda det här verktyget

  • Få grov HTML från PDF med textlager
  • Ta sidbilder som pdftohtml dragit ut
  • Se hur Poppler tolkar filen före ett eget flöde

Hur konverterar jag en PDF till HTML?

  1. Ladda upp PDF. Inga konverteringsalternativ på den här sidan.
  2. Klicka på Bearbeta och ladda ner `{name}ToHtml.zip`.
  3. Packa upp och öppna HTML i en webbläsare.
  4. Kontrollera bilder och text. Skanningar blir inte riktig HTML-text.

Gränser och specialfall

  • Utdata är ZIP, inte ensam HTML
  • Inte Chromium-utskrift och inte tagged-PDF HTML-export
  • Tom pdftohtml-utdata är fel, inte 204
  • Uppladdningsgräns på webbplatsen: 500 MB per fil, som skickas i delar över cirka 95 MB. Innehållet i en enskild direkt API-förfrågan är begränsat till 100 MB.

Exempel

  • En enkel textpromemoria packas ofta upp till HTML plus några bilder
  • Ren skannings-PDF ger HTML som mest packar sidbilderna

Integritet för det här verktyget

Filer laddas upp via HTTPS, bearbetas i serverns minne eller en kortlivad tillfällig katalog och raderas när resultatet är klart. Vi behåller inga kopior för senare bläddring, träning eller annonsprofiler. Se integritetspolicyn för lagringstider och AdSense-cookieupplysningar.

Vanliga frågor

Varför är resultatet en ZIP?
pdftohtml skriver HTML plus utdragna bilder till en mapp. Servern packar mappen.
Matchar HTML PDF-layouten?
Bara så långt Poppler `-c` räcker. Flerspaltiga magasin och mycket vektorer missar ofta.
Kan skanningar bli HTML-text?
Nej. Vägen gör ingen OCR. Behöver du text: OCR till Markdown.
Sker konverteringen i webbläsaren?
Nej. Servern anropar pdftohtml.

Senast uppdaterad:

Anropa från kod

Varje verktyg på webbplatsen är ett vanligt REST-anrop. För anonym användning behövs varken konto eller API-nyckel. Lika mycket för AI-agenter och utvecklare som för webbläsaren.

curl -X POST "https://pdf123.xyz/api/v1/convert/pdf/html" \
  -F "[email protected]" \
  -o output.pdf

Finns också som MCP-verktyg för klienter som talar Model Context Protocol (JSON-RPC 2.0 via POST /mcp). Fullständig API-referens

Använd den från en AI-agent

Skill

Med den här skillen kan Claude Code, Codex, Cursor och andra AI-agenter köra ”PDF till HTML” åt dig: /skills/pdf123-pdf-to-html.md

Alla agent-skills

Filerna används bara för den här körningen och raderas automatiskt efteråt.