Konvertera PDF till HTML
PDF till HTML konverterar en PDF med Popplers pdftohtml och levererar en ZIP med HTML-sidorna och deras bilder. Det är en layoutdump snarare än ren webbmarkup, och den kör ingen OCR.
Dra filer hit, eller klicka för att välja
Tar emot PDF · upp till 500.0 MB per fil · upp till 20 filer åt gången
Du kan också klistra in en fil med Ctrl/Cmd+V eller via urklippsmenyn.
PDF till HTML kör Poppler `pdftohtml -c` och zippar det verktyget skriver till utdatakatalogen. Nedladdningsnamnet är `{base}ToHtml.zip`, inte en ensam `.html`. Målet är Popplers HTML- och bildexport, inte webbläsar-CSS.
Sidan har inga formulärfält. Varje sida konverteras. Om `pdftohtml` inte skriver något returnerar API:et internt fel, inte tom ZIP.
Det här är ingen OCR. Rena bildskanningar blir bilder i HTML-paketet, inte markerbar text. Lösenordsskyddade filer låses upp åt dig på den här sidan när du anger lösenordet; API-anropare kör Ta bort lösenord först.
Vill du bara ha text, använd PDF till RTF. Vill du ha CMS-vänlig artikeltext, använd PDF till Markdown.
Uppladdningar är tillfälliga. Vi sparar ingen HTML-katalog.
Funktioner
- Poppler `pdftohtml -c`, ZIP med HTML och resurser
- Inga sidintervall- eller temaalternativ
- Ingen OCR; skanningar förblir bilder i paketet
- Anonym API: /api/v1/convert/pdf/html
När du ska använda det här verktyget
- Få grov HTML från PDF med textlager
- Ta sidbilder som pdftohtml dragit ut
- Se hur Poppler tolkar filen före ett eget flöde
Hur konverterar jag en PDF till HTML?
- Ladda upp PDF. Inga konverteringsalternativ på den här sidan.
- Klicka på Bearbeta och ladda ner `{name}ToHtml.zip`.
- Packa upp och öppna HTML i en webbläsare.
- Kontrollera bilder och text. Skanningar blir inte riktig HTML-text.
Gränser och specialfall
- Utdata är ZIP, inte ensam HTML
- Inte Chromium-utskrift och inte tagged-PDF HTML-export
- Tom pdftohtml-utdata är fel, inte 204
- Uppladdningsgräns på webbplatsen: 500 MB per fil, som skickas i delar över cirka 95 MB. Innehållet i en enskild direkt API-förfrågan är begränsat till 100 MB.
Exempel
- En enkel textpromemoria packas ofta upp till HTML plus några bilder
- Ren skannings-PDF ger HTML som mest packar sidbilderna
Integritet för det här verktyget
Filer laddas upp via HTTPS, bearbetas i serverns minne eller en kortlivad tillfällig katalog och raderas när resultatet är klart. Vi behåller inga kopior för senare bläddring, träning eller annonsprofiler. Se integritetspolicyn för lagringstider och AdSense-cookieupplysningar.
Vanliga frågor
- Varför är resultatet en ZIP?
- pdftohtml skriver HTML plus utdragna bilder till en mapp. Servern packar mappen.
- Matchar HTML PDF-layouten?
- Bara så långt Poppler `-c` räcker. Flerspaltiga magasin och mycket vektorer missar ofta.
- Kan skanningar bli HTML-text?
- Nej. Vägen gör ingen OCR. Behöver du text: OCR till Markdown.
- Sker konverteringen i webbläsaren?
- Nej. Servern anropar pdftohtml.
Senast uppdaterad:
Anropa från kod
Varje verktyg på webbplatsen är ett vanligt REST-anrop. För anonym användning behövs varken konto eller API-nyckel. Lika mycket för AI-agenter och utvecklare som för webbläsaren.
curl -X POST "https://pdf123.xyz/api/v1/convert/pdf/html" \
-F "[email protected]" \
-o output.pdfFinns också som MCP-verktyg för klienter som talar Model Context Protocol (JSON-RPC 2.0 via POST /mcp). Fullständig API-referens
Använd den från en AI-agent
SkillMed den här skillen kan Claude Code, Codex, Cursor och andra AI-agenter köra ”PDF till HTML” åt dig: /skills/pdf123-pdf-to-html.md
Filerna används bara för den här körningen och raderas automatiskt efteråt.