Vai al contenuto principale
PPDF123

Converti le tabelle di un PDF in Excel

PDF in Excel trova righe di tabella allineate nel testo di un PDF e scrive ogni tabella in un foglio a sé di una cartella .xlsx. Serve un livello di testo e non restituisce nulla per prosa o pagine scansionate.

Trascina i file qui, o clicca per sceglierli

Accetta PDF · fino a 500.0 MB per file · fino a 20 file alla volta

Puoi anche incollare un file con Ctrl/Cmd+V o dal menu degli appunti.

PDF in Excel esegue `pdftotext -layout`, cerca righe con due o più spazi consecutivi e scrive quelle righe in una cartella di lavoro `.xlsx`. Ogni tabella rilevata diventa un foglio chiamato `Page N` o `Page N Table M`. Va bene per PDF digitali le cui colonne sono già allineate nel testo estratto.

Una tabella richiede almeno due righe consecutive simili a tabella. Prosa, una sola riga di intestazione, o scansioni senza livello di testo danno `no_content`: nessuna cartella di lavoro. Il risultato vuoto è intenzionale, non un fallimento silenzioso.

Questo strumento ignora i parametri della richiesta. Questa pagina non ha un campo intervallo pagine. Le colonne si spezzano su due o più spazi consecutivi; uno spazio singolo resta dentro la cella.

Non è OCR. Una scansione solo-immagine non ha contenuto che `pdftotext` possa leggere. L'OCR di questo sito restituisce Markdown, che non può essere rimandato a PDF in Excel. Se le parole esistono solo come pixel, qui non ottieni un foglio.

PDF in CSV usa la stessa euristica di layout. Una tabella diventa un CSV; più tabelle diventano uno ZIP di CSV. Excel mette quelle tabelle come fogli nella stessa cartella di lavoro. Nessuno dei due ricostruisce celle unite, intestazioni colorate o fogli nascosti dal PDF.

Apri lo scaricamento in Excel o LibreOffice Calc e controlla qualche riga di spezzatura colonne. Tabelle strette senza gap a doppio spazio spesso finiscono in una sola colonna. I file protetti da password vengono sbloccati per te su questa pagina una volta inserita la password; chi usa l'API deve prima passare da Rimuovi password.

La regola dei due spazi è l'intero meccanismo di rilevamento, quindi la qualità della cartella dipende del tutto da come è stato composto il PDF. Le tabelle prodotte da generatori di report che riempiono ogni cella a larghezza fissa si estraggono in modo pulito. Le tabelle con un solo spazio tra le colonne, o con font proporzionali che avvicinano quasi le colonne, non vengono registrate affatto come tabelle e possono non produrre alcuna cartella. Prima di dare la colpa allo strumento, seleziona una riga del PDF e verifica che il testo sia davvero selezionabile.

I nomi dei fogli seguono la posizione, non il contenuto. Ogni blocco rilevato diventa `Page N` o `Page N Table M`, nell'ordine in cui vengono scansionate le pagine. Un report con una tabella per pagina produce un foglio per pagina; una pagina con tre tabelle impilate produce tre fogli numerati. Non c'è opzione per nominare i fogli da una cella di intestazione, né un output combinato in un unico foglio.

I valori sono scritti come testo, esattamente come apparivano nell'estrazione che preserva il layout. I numeri non vengono convertiti in celle numeriche, quindi gli zeri iniziali sopravvivono e i simboli di valuta e i separatori delle migliaia restano nella stringa. Di solito è ciò che vuoi per numeri di conto e codici postali, e un po' fastidioso per una colonna di importi che intendi sommare. Converti i tipi nel foglio di calcolo, oppure copia la colonna e usa testo in colonne o la conversione di valori del programma di destinazione.

Le righe non vengono deduplicate e le intestazioni ripetute non vengono rimosse. Quando una tabella si spezza a un salto di pagina, la riga di intestazione spesso si ripete sulla pagina successiva e la continuazione diventa un foglio a sé. Le celle unite non vengono ricostruite; una cella che nel PDF copriva due colonne ha semplicemente il testo nella colonna più a sinistra, mentre la destra resta vuota. Le celle su più righe diventano righe separate invece di un unico valore mandato a capo.

I caricamenti sono temporanei. Non teniamo una biblioteca di cartelle di lavoro.

Funzioni

  • `pdftotext -layout` più euristica di colonne a doppio spazio
  • Un foglio per tabella rilevata; nessun file se il rilevamento è vuoto
  • Non è OCR; il Markdown dell'OCR non può arrivare qui
  • Celle di tipo testo; nessuna inferenza di tipo né ricostruzione delle celle unite
  • API anonima: /api/v1/convert/pdf/xlsx

Quando usarlo

  • Aprire tabelle estratte direttamente in Excel o LibreOffice Calc
  • Tirare tabelle di fatture digitali in una cartella di lavoro
  • Avere un foglio per tabella su più pagine invece di un solo CSV
  • Estrarre un prospetto finanziario a larghezza fissa per analizzarlo meglio

Come convertire una tabella PDF in Excel?

  1. Carica un PDF che abbia già testo selezionabile in colonne di tipo tabella.
  2. Fai clic su Elabora. Questo strumento non ha intervallo pagine né opzioni OCR.
  3. Se trova tabelle, scarica il `.xlsx`. Se no, ottieni un successo vuoto; prova una sorgente con livello di testo.
  4. Apri la cartella di lavoro e controlla lo spezzamento. Un PDF di sola prosa non produce fogli.

Limiti e casi limite

  • Serve testo selezionabile e gap di colonna a doppio spazio
  • Niente OCR e niente controllo intervallo pagine
  • Celle unite e stili non vengono ricostruiti
  • Tutti i valori sono testo; nessuna tipizzazione numerica o di data
  • Le tabelle che proseguono su più pagine diventano fogli separati
  • Limite di caricamento su questo sito: 500 MB per file, inviati a blocchi oltre circa 95 MB. Il corpo di una singola richiesta API diretta è limitato a 100 MB.

Esempi

  • Un PDF di testo con listino a tre colonne spesso diventa un foglio con quelle colonne
  • Un estratto conto bancario scansionato senza livello di testo non restituisce una cartella di lavoro
  • Un report di dieci pagine con una tabella per pagina dà dieci fogli da Page 1 a Page 10

Privacy di questo strumento

I file vengono caricati su HTTPS, elaborati in memoria o in una directory temporanea di breve durata sui nostri server, e cancellati quando il risultato è pronto. Non conserviamo copie per consultarle in seguito, per addestrare modelli o per profili pubblicitari. Consulta l'Informativa sulla privacy per i tempi di conservazione e i cookie AdSense.

Domande frequenti

Perché non ho ottenuto un foglio di calcolo?
Non è stato trovato alcun blocco di due o più righe di tabella consecutive. Scansioni, prosa e tabelle senza gap a doppio spazio fanno fallire l'euristica.
Posso fare OCR prima e poi convertire in Excel?
No. L'OCR restituisce Markdown. Questo strumento legge solo PDF tramite pdftotext.
In cosa differisce da PDF in CSV?
Lo stesso rilevamento. Excel scrive ogni tabella in un foglio della stessa cartella. CSV dà un file per tabella (un CSV se ne c'è una, ZIP se sono più).
Legge ogni pagina?
Sì. pdftotext pagina per form-feed. Ogni pagina viene scansionata per blocchi tabella. Non c'è parametro di intervallo.
Perché i miei numeri sono salvati come testo?
I valori vengono scritti esattamente come estratti, così gli zeri iniziali e la formattazione sopravvivono. Converti la colonna in numerica nel foglio di calcolo se devi calcolarci.
Le celle unite vengono ricostruite?
No. Il testo di una cella unita finisce nella colonna più a sinistra e le altre restano vuote. Le celle su più righe diventano righe separate invece di un unico valore mandato a capo.
Perché ho più fogli per una sola tabella?
Una tabella che continua su una nuova pagina viene rilevata di nuovo lì e diventa un altro foglio. Le righe di intestazione spesso si ripetono; lo strumento non unisce i frammenti.

Ultimo aggiornamento:

Chiamalo dal codice

Ogni strumento del sito è un'interfaccia REST. Per l'uso anonimo non servono account né chiave API. Va bene per browser, sviluppatori e agenti IA.

curl -X POST "https://pdf123.xyz/api/v1/convert/pdf/xlsx" \
  -F "[email protected]" \
  -o output.pdf

Disponibile anche come strumento MCP per i client che parlano Model Context Protocol (JSON-RPC 2.0 su POST /mcp). Riferimento API completo

Usalo da un agente IA

Skill

Con questa skill, Claude Code, Codex, Cursor e altri agenti IA possono eseguire «PDF in Excel» al posto tuo: /skills/pdf123-pdf-to-xlsx.md

Tutte le skill per agenti

I file servono solo a questa elaborazione e poi vengono cancellati.