Converti le tabelle di un PDF in Excel
PDF in Excel trova righe di tabella allineate nel testo di un PDF e scrive ogni tabella in un foglio a sé di una cartella .xlsx. Serve un livello di testo e non restituisce nulla per prosa o pagine scansionate.
Trascina i file qui, o clicca per sceglierli
Accetta PDF · fino a 500.0 MB per file · fino a 20 file alla volta
Puoi anche incollare un file con Ctrl/Cmd+V o dal menu degli appunti.
PDF in Excel esegue `pdftotext -layout`, cerca righe con due o più spazi consecutivi e scrive quelle righe in una cartella di lavoro `.xlsx`. Ogni tabella rilevata diventa un foglio chiamato `Page N` o `Page N Table M`. Va bene per PDF digitali le cui colonne sono già allineate nel testo estratto.
Una tabella richiede almeno due righe consecutive simili a tabella. Prosa, una sola riga di intestazione, o scansioni senza livello di testo danno `no_content`: nessuna cartella di lavoro. Il risultato vuoto è intenzionale, non un fallimento silenzioso.
Questo strumento ignora i parametri della richiesta. Questa pagina non ha un campo intervallo pagine. Le colonne si spezzano su due o più spazi consecutivi; uno spazio singolo resta dentro la cella.
Non è OCR. Una scansione solo-immagine non ha contenuto che `pdftotext` possa leggere. L'OCR di questo sito restituisce Markdown, che non può essere rimandato a PDF in Excel. Se le parole esistono solo come pixel, qui non ottieni un foglio.
PDF in CSV usa la stessa euristica di layout. Una tabella diventa un CSV; più tabelle diventano uno ZIP di CSV. Excel mette quelle tabelle come fogli nella stessa cartella di lavoro. Nessuno dei due ricostruisce celle unite, intestazioni colorate o fogli nascosti dal PDF.
Apri lo scaricamento in Excel o LibreOffice Calc e controlla qualche riga di spezzatura colonne. Tabelle strette senza gap a doppio spazio spesso finiscono in una sola colonna. I file protetti da password vengono sbloccati per te su questa pagina una volta inserita la password; chi usa l'API deve prima passare da Rimuovi password.
La regola dei due spazi è l'intero meccanismo di rilevamento, quindi la qualità della cartella dipende del tutto da come è stato composto il PDF. Le tabelle prodotte da generatori di report che riempiono ogni cella a larghezza fissa si estraggono in modo pulito. Le tabelle con un solo spazio tra le colonne, o con font proporzionali che avvicinano quasi le colonne, non vengono registrate affatto come tabelle e possono non produrre alcuna cartella. Prima di dare la colpa allo strumento, seleziona una riga del PDF e verifica che il testo sia davvero selezionabile.
I nomi dei fogli seguono la posizione, non il contenuto. Ogni blocco rilevato diventa `Page N` o `Page N Table M`, nell'ordine in cui vengono scansionate le pagine. Un report con una tabella per pagina produce un foglio per pagina; una pagina con tre tabelle impilate produce tre fogli numerati. Non c'è opzione per nominare i fogli da una cella di intestazione, né un output combinato in un unico foglio.
I valori sono scritti come testo, esattamente come apparivano nell'estrazione che preserva il layout. I numeri non vengono convertiti in celle numeriche, quindi gli zeri iniziali sopravvivono e i simboli di valuta e i separatori delle migliaia restano nella stringa. Di solito è ciò che vuoi per numeri di conto e codici postali, e un po' fastidioso per una colonna di importi che intendi sommare. Converti i tipi nel foglio di calcolo, oppure copia la colonna e usa testo in colonne o la conversione di valori del programma di destinazione.
Le righe non vengono deduplicate e le intestazioni ripetute non vengono rimosse. Quando una tabella si spezza a un salto di pagina, la riga di intestazione spesso si ripete sulla pagina successiva e la continuazione diventa un foglio a sé. Le celle unite non vengono ricostruite; una cella che nel PDF copriva due colonne ha semplicemente il testo nella colonna più a sinistra, mentre la destra resta vuota. Le celle su più righe diventano righe separate invece di un unico valore mandato a capo.
I caricamenti sono temporanei. Non teniamo una biblioteca di cartelle di lavoro.
Funzioni
- `pdftotext -layout` più euristica di colonne a doppio spazio
- Un foglio per tabella rilevata; nessun file se il rilevamento è vuoto
- Non è OCR; il Markdown dell'OCR non può arrivare qui
- Celle di tipo testo; nessuna inferenza di tipo né ricostruzione delle celle unite
- API anonima: /api/v1/convert/pdf/xlsx
Quando usarlo
- Aprire tabelle estratte direttamente in Excel o LibreOffice Calc
- Tirare tabelle di fatture digitali in una cartella di lavoro
- Avere un foglio per tabella su più pagine invece di un solo CSV
- Estrarre un prospetto finanziario a larghezza fissa per analizzarlo meglio
Come convertire una tabella PDF in Excel?
- Carica un PDF che abbia già testo selezionabile in colonne di tipo tabella.
- Fai clic su Elabora. Questo strumento non ha intervallo pagine né opzioni OCR.
- Se trova tabelle, scarica il `.xlsx`. Se no, ottieni un successo vuoto; prova una sorgente con livello di testo.
- Apri la cartella di lavoro e controlla lo spezzamento. Un PDF di sola prosa non produce fogli.
Limiti e casi limite
- Serve testo selezionabile e gap di colonna a doppio spazio
- Niente OCR e niente controllo intervallo pagine
- Celle unite e stili non vengono ricostruiti
- Tutti i valori sono testo; nessuna tipizzazione numerica o di data
- Le tabelle che proseguono su più pagine diventano fogli separati
- Limite di caricamento su questo sito: 500 MB per file, inviati a blocchi oltre circa 95 MB. Il corpo di una singola richiesta API diretta è limitato a 100 MB.
Esempi
- Un PDF di testo con listino a tre colonne spesso diventa un foglio con quelle colonne
- Un estratto conto bancario scansionato senza livello di testo non restituisce una cartella di lavoro
- Un report di dieci pagine con una tabella per pagina dà dieci fogli da Page 1 a Page 10
Privacy di questo strumento
I file vengono caricati su HTTPS, elaborati in memoria o in una directory temporanea di breve durata sui nostri server, e cancellati quando il risultato è pronto. Non conserviamo copie per consultarle in seguito, per addestrare modelli o per profili pubblicitari. Consulta l'Informativa sulla privacy per i tempi di conservazione e i cookie AdSense.
Domande frequenti
- Perché non ho ottenuto un foglio di calcolo?
- Non è stato trovato alcun blocco di due o più righe di tabella consecutive. Scansioni, prosa e tabelle senza gap a doppio spazio fanno fallire l'euristica.
- Posso fare OCR prima e poi convertire in Excel?
- No. L'OCR restituisce Markdown. Questo strumento legge solo PDF tramite pdftotext.
- In cosa differisce da PDF in CSV?
- Lo stesso rilevamento. Excel scrive ogni tabella in un foglio della stessa cartella. CSV dà un file per tabella (un CSV se ne c'è una, ZIP se sono più).
- Legge ogni pagina?
- Sì. pdftotext pagina per form-feed. Ogni pagina viene scansionata per blocchi tabella. Non c'è parametro di intervallo.
- Perché i miei numeri sono salvati come testo?
- I valori vengono scritti esattamente come estratti, così gli zeri iniziali e la formattazione sopravvivono. Converti la colonna in numerica nel foglio di calcolo se devi calcolarci.
- Le celle unite vengono ricostruite?
- No. Il testo di una cella unita finisce nella colonna più a sinistra e le altre restano vuote. Le celle su più righe diventano righe separate invece di un unico valore mandato a capo.
- Perché ho più fogli per una sola tabella?
- Una tabella che continua su una nuova pagina viene rilevata di nuovo lì e diventa un altro foglio. Le righe di intestazione spesso si ripetono; lo strumento non unisce i frammenti.
Ultimo aggiornamento:
Chiamalo dal codice
Ogni strumento del sito è un'interfaccia REST. Per l'uso anonimo non servono account né chiave API. Va bene per browser, sviluppatori e agenti IA.
curl -X POST "https://pdf123.xyz/api/v1/convert/pdf/xlsx" \
-F "[email protected]" \
-o output.pdfDisponibile anche come strumento MCP per i client che parlano Model Context Protocol (JSON-RPC 2.0 su POST /mcp). Riferimento API completo
Usalo da un agente IA
SkillCon questa skill, Claude Code, Codex, Cursor e altri agenti IA possono eseguire «PDF in Excel» al posto tuo: /skills/pdf123-pdf-to-xlsx.md
I file servono solo a questa elaborazione e poi vengono cancellati.