Vai al contenuto principale
PPDF123

Converti PDF in HTML

PDF in HTML converte un PDF con pdftohtml di Poppler e consegna uno ZIP con le pagine HTML e le loro immagini. È un dump di layout più che un markup web pulito, e non fa OCR.

Trascina i file qui, o clicca per sceglierli

Accetta PDF · fino a 500.0 MB per file · fino a 20 file alla volta

Puoi anche incollare un file con Ctrl/Cmd+V o dal menu degli appunti.

PDF in HTML esegue Poppler `pdftohtml -c` e mette in ZIP ciò che lo strumento scrive nella directory di output. Il nome dello scaricamento è `{base}ToHtml.zip`, non un singolo `.html`. L'obiettivo non è CSS da browser, ma l'export HTML+immagini di Poppler.

Non è un'edizione web fedele. Posizionamento assoluto e immagini di sfondo sono tipici. JavaScript del PDF non viene eseguito.

I file protetti da password vengono sbloccati per te su questa pagina una volta inserita la password; chi usa l'API deve prima passare da Rimuovi password.

I caricamenti sono temporanei. Scarica lo ZIP a job finito.

Non teniamo una biblioteca HTML dei tuoi PDF.

Funzioni

  • Poppler pdftohtml -c → ZIP
  • Nome `{base}ToHtml.zip`
  • Non è HTML semantico da sito
  • API anonima: /api/v1/convert/pdf/html

Quando usarlo

  • Ispezionare contenuto PDF come HTML+immagini
  • Recuperare testo/immagini via export Poppler
  • Anteprima grezza in ambienti che preferiscono HTML

Come convertire un PDF in HTML?

  1. Carica un PDF.
  2. Fai clic su Elabora.
  3. Scarica lo ZIP e aprilo in locale.
  4. Apri l'HTML di Poppler in un browser e ispeziona.

Limiti e casi limite

  • Non è HTML web-quality
  • Niente OCR
  • I file protetti da password richiedono la password; chi usa l'API deve prima passare da Rimuovi password
  • Limite di caricamento su questo sito: 500 MB per file, inviati a blocchi oltre circa 95 MB. Il corpo di una singola richiesta API diretta è limitato a 100 MB.

Esempi

  • manual.pdf produce manualToHtml.zip con HTML e PNG
  • Un PDF solo vettoriale può comunque espandere molte immagini di disegno

Privacy di questo strumento

I file vengono caricati su HTTPS, elaborati in memoria o in una directory temporanea di breve durata sui nostri server, e cancellati quando il risultato è pronto. Non conserviamo copie per consultarle in seguito, per addestrare modelli o per profili pubblicitari. Consulta l'Informativa sulla privacy per i tempi di conservazione e i cookie AdSense.

Domande frequenti

Perché uno ZIP?
pdftohtml scrive HTML più immagini. Lo ZIP le contiene tutte.
Ottengo HTML pulito?
Di solito no. È l'export Poppler, spesso con posizionamento assoluto.
Fa OCR?
No.
È WeasyPrint al contrario?
No. È Poppler, non WeasyPrint.

Ultimo aggiornamento:

Chiamalo dal codice

Ogni strumento del sito è un'interfaccia REST. Per l'uso anonimo non servono account né chiave API. Va bene per browser, sviluppatori e agenti IA.

curl -X POST "https://pdf123.xyz/api/v1/convert/pdf/html" \
  -F "[email protected]" \
  -o output.pdf

Disponibile anche come strumento MCP per i client che parlano Model Context Protocol (JSON-RPC 2.0 su POST /mcp). Riferimento API completo

Usalo da un agente IA

Skill

Con questa skill, Claude Code, Codex, Cursor e altri agenti IA possono eseguire «PDF in HTML» al posto tuo: /skills/pdf123-pdf-to-html.md

Tutte le skill per agenti

I file servono solo a questa elaborazione e poi vengono cancellati.