Converti PDF in HTML
PDF in HTML converte un PDF con pdftohtml di Poppler e consegna uno ZIP con le pagine HTML e le loro immagini. È un dump di layout più che un markup web pulito, e non fa OCR.
Trascina i file qui, o clicca per sceglierli
Accetta PDF · fino a 500.0 MB per file · fino a 20 file alla volta
Puoi anche incollare un file con Ctrl/Cmd+V o dal menu degli appunti.
PDF in HTML esegue Poppler `pdftohtml -c` e mette in ZIP ciò che lo strumento scrive nella directory di output. Il nome dello scaricamento è `{base}ToHtml.zip`, non un singolo `.html`. L'obiettivo non è CSS da browser, ma l'export HTML+immagini di Poppler.
Non è un'edizione web fedele. Posizionamento assoluto e immagini di sfondo sono tipici. JavaScript del PDF non viene eseguito.
I file protetti da password vengono sbloccati per te su questa pagina una volta inserita la password; chi usa l'API deve prima passare da Rimuovi password.
I caricamenti sono temporanei. Scarica lo ZIP a job finito.
Non teniamo una biblioteca HTML dei tuoi PDF.
Funzioni
- Poppler pdftohtml -c → ZIP
- Nome `{base}ToHtml.zip`
- Non è HTML semantico da sito
- API anonima: /api/v1/convert/pdf/html
Quando usarlo
- Ispezionare contenuto PDF come HTML+immagini
- Recuperare testo/immagini via export Poppler
- Anteprima grezza in ambienti che preferiscono HTML
Come convertire un PDF in HTML?
- Carica un PDF.
- Fai clic su Elabora.
- Scarica lo ZIP e aprilo in locale.
- Apri l'HTML di Poppler in un browser e ispeziona.
Limiti e casi limite
- Non è HTML web-quality
- Niente OCR
- I file protetti da password richiedono la password; chi usa l'API deve prima passare da Rimuovi password
- Limite di caricamento su questo sito: 500 MB per file, inviati a blocchi oltre circa 95 MB. Il corpo di una singola richiesta API diretta è limitato a 100 MB.
Esempi
- manual.pdf produce manualToHtml.zip con HTML e PNG
- Un PDF solo vettoriale può comunque espandere molte immagini di disegno
Privacy di questo strumento
I file vengono caricati su HTTPS, elaborati in memoria o in una directory temporanea di breve durata sui nostri server, e cancellati quando il risultato è pronto. Non conserviamo copie per consultarle in seguito, per addestrare modelli o per profili pubblicitari. Consulta l'Informativa sulla privacy per i tempi di conservazione e i cookie AdSense.
Domande frequenti
- Perché uno ZIP?
- pdftohtml scrive HTML più immagini. Lo ZIP le contiene tutte.
- Ottengo HTML pulito?
- Di solito no. È l'export Poppler, spesso con posizionamento assoluto.
- Fa OCR?
- No.
- È WeasyPrint al contrario?
- No. È Poppler, non WeasyPrint.
Ultimo aggiornamento:
Chiamalo dal codice
Ogni strumento del sito è un'interfaccia REST. Per l'uso anonimo non servono account né chiave API. Va bene per browser, sviluppatori e agenti IA.
curl -X POST "https://pdf123.xyz/api/v1/convert/pdf/html" \
-F "[email protected]" \
-o output.pdfDisponibile anche come strumento MCP per i client che parlano Model Context Protocol (JSON-RPC 2.0 su POST /mcp). Riferimento API completo
Usalo da un agente IA
SkillCon questa skill, Claude Code, Codex, Cursor e altri agenti IA possono eseguire «PDF in HTML» al posto tuo: /skills/pdf123-pdf-to-html.md
I file servono solo a questa elaborazione e poi vengono cancellati.