Converteix un PDF a HTML
PDF a HTML converteix un PDF amb pdftohtml de Poppler i lliura un ZIP amb les pàgines HTML i les seves imatges. És un bolcat de maquetació i no HTML net per al web, i no fa OCR.
Arrossega arxius aquí, o fes clic per triar-los
Admet PDF · fins a 500.0 MB per arxiu · fins a 20 arxius alhora
També pots enganxar un fitxer amb Ctrl/Cmd+V o des del menú del porta-retalls.
PDF a HTML executa Poppler `pdftohtml -c` i empaqueta el que l'eina escriu al directori de sortida en un ZIP. El nom de baixada és `{base}ToHtml.zip` (o `{name}ToHtml.zip`), no un sol `.html`. L'objectiu no és CSS de nivell de navegador modern, sinó la sortida típica de Poppler.
La fidelitat visual varia. Complexitat tipogràfica i superposicions poden degradar-se.
No és OCR. Els escaneigs sense text no esdevenen HTML útil.
Els fitxers protegits amb contrasenya es desbloquegen per vosaltres en aquesta pàgina un cop n'escriviu la clau; els clients d'API executen primer «Treu la contrasenya».
Les pujades són temporals. No desem el vostre lloc convertit.
Funcions
- Poppler pdftohtml -c empaquetat en ZIP
- Nom de baixada tipus {base}ToHtml.zip
- No és una conversió CSS perfecta de navegador
- API anònima: /api/v1/convert/pdf/html
Quan fer-la servir
- Obtenir una vista HTML aproximada d'un informe
- Extreure recursos que pdftohtml escriu al directori
- Preparar una còpia web rudimentària d'un PDF electrònic
Com converteixo un PDF a HTML?
- Pugeu un PDF amb contingut que vulgueu en HTML.
- Feu clic a Processar.
- Baixeu el ZIP i descomprimiu-lo.
- Obriu l'HTML principal al navegador i reviseu el resultat.
Límits i casos límit
- Fidelitat limitada
- Sense OCR
- Els fitxers protegits amb contrasenya en necessiten la clau; els clients d'API executen primer «Treu la contrasenya»
- Límit de pujada en aquest web: 500 MB per fitxer, enviat per parts a partir d'uns 95 MB. El cos d'una sola petició directa a l'API està limitat a 100 MB.
Exemples
- Un article senzill pot donar un HTML llegible dins del ZIP
- Un disseny molt gràfic pot fragmentar-se en moltes imatges
Privadesa d'aquesta eina
Els fitxers pugen per HTTPS, es processen a la memòria del servidor o en un directori temporal de curta vida, i s'esborren quan el resultat és a punt. No en guardem còpies per consultar-les després, per entrenar models ni per a perfils publicitaris. Els terminis de retenció i les galetes d'AdSense consten a la Política de privacitat.
Preguntes freqüents
- Per què és un ZIP?
- pdftohtml genera diversos fitxers (HTML, imatges). S'empaqueten junts.
- Quedarà idèntic al PDF?
- No ho prometem. És la millor aproximació de Poppler.
- Fa OCR?
- No.
- Cal treure la contrasenya abans?
- No al web: la pàgina us demana la clau i desbloqueja el fitxer per vosaltres. Els clients d'API executen primer «Treu la contrasenya».
Darrera actualització:
Crida-ho des del codi
Cada eina del lloc és una interfície REST normal. Per a ús anònim no cal compte ni clau API. Pensat per a agents d'IA i desenvolupadors, igual que per al navegador.
curl -X POST "https://pdf123.xyz/api/v1/convert/pdf/html" \
-F "[email protected]" \
-o output.pdfTambé hi ha una eina MCP per a clients d'agents que parlen Model Context Protocol (JSON-RPC 2.0 amb POST /mcp). Referència completa de l'API
Fes-lo servir des d'un agent d'IA
SkillAmb aquest skill, Claude Code, Codex, Cursor i altres agents d'IA poden executar «PDF a HTML» per tu: /skills/pdf123-pdf-to-html.md
Els arxius només serveixen per a aquest processament i s'esborren sols després.