Vai al contenuto principale
PPDF123

Estrai le tabelle di un PDF in CSV

PDF in CSV trova righe di tabella allineate nel testo di un PDF e scrive ogni tabella rilevata come file CSV; più tabelle tornano in uno ZIP. Serve un livello di testo e non restituisce nulla per prosa o scansioni.

Trascina i file qui, o clicca per sceglierli

Accetta PDF · fino a 500.0 MB per file · fino a 20 file alla volta

Puoi anche incollare un file con Ctrl/Cmd+V o dal menu degli appunti.

PDF in CSV esegue `pdftotext -layout`, cerca righe con due o più spazi consecutivi e scrive quelle righe come CSV. Una tabella rilevata diventa un file CSV; più tabelle diventano uno ZIP di CSV. Va bene per PDF digitali le cui colonne sono già allineate nel testo estratto.

Una tabella richiede almeno due righe consecutive simili a tabella. Prosa, una sola riga di intestazione, o scansioni senza livello di testo danno `no_content`: HTTP 204, nessun file. Il risultato vuoto è intenzionale, non un fallimento silenzioso.

Questo strumento ignora i parametri della richiesta. Questa pagina non ha un campo intervallo pagine. Le colonne si spezzano su due o più spazi consecutivi; uno spazio singolo resta dentro la cella.

Non è OCR. Una scansione solo-immagine non ha contenuto che `pdftotext` possa leggere. L'OCR di questo sito restituisce Markdown, che non può essere rimandato a PDF in CSV. Se le parole esistono solo come pixel, qui non ottieni un CSV.

PDF in Excel usa la stessa euristica di layout ma mette ogni tabella in un foglio della stessa cartella `.xlsx`. CSV dà un file per tabella. Nessuno dei due ricostruisce celle unite, intestazioni colorate o fogli nascosti dal PDF.

Apri lo scaricamento e controlla qualche riga di spezzatura colonne. Tabelle strette senza gap a doppio spazio spesso finiscono in una sola colonna. I file protetti da password vengono sbloccati per te su questa pagina una volta inserita la password; chi usa l'API deve prima passare da Rimuovi password.

I caricamenti sono temporanei. Non teniamo una biblioteca di CSV.

Funzioni

  • `pdftotext -layout` più euristica di colonne a doppio spazio
  • Un CSV per tabella; ZIP se ce n'è più di una; rilevamento vuoto → HTTP 204
  • Non è OCR; il Markdown dell'OCR non può arrivare qui
  • API anonima: /api/v1/convert/pdf/csv

Quando usarlo

  • Estrarre tabelle allineate per pipeline che vogliono CSV
  • Tirare listini digitali in un foglio di calcolo via CSV
  • Ottenere un file per tabella invece di una cartella multipagina

Come estrarre una tabella da un PDF in CSV?

  1. Carica un PDF con testo selezionabile e colonne di tipo tabella.
  2. Fai clic su Elabora. Questo strumento non ha intervallo pagine né opzioni OCR.
  3. Se trova tabelle, scarica il CSV o lo ZIP. Se no, ottieni un successo vuoto; cambia sorgente con livello di testo.
  4. Apri il CSV e controlla lo spezzamento. Un PDF di sola prosa non produce file.

Limiti e casi limite

  • Serve testo selezionabile e gap di colonna a doppio spazio
  • Niente OCR e niente controllo intervallo pagine
  • Non ricostruisce celle unite né stili
  • Limite di caricamento su questo sito: 500 MB per file, inviati a blocchi oltre circa 95 MB. Il corpo di una singola richiesta API diretta è limitato a 100 MB.

Esempi

  • Un PDF di testo con listino a tre colonne spesso diventa un CSV con quelle colonne
  • Un estratto conto scansionato senza livello di testo dà HTTP 204

Privacy di questo strumento

I file vengono caricati su HTTPS, elaborati in memoria o in una directory temporanea di breve durata sui nostri server, e cancellati quando il risultato è pronto. Non conserviamo copie per consultarle in seguito, per addestrare modelli o per profili pubblicitari. Consulta l'Informativa sulla privacy per i tempi di conservazione e i cookie AdSense.

Domande frequenti

Perché non c'è un CSV?
Non sono state trovate due o più righe consecutive di tabella. Scansioni, prosa e tabelle senza gap a doppio spazio fanno fallire l'euristica. L'API risponde 204 `no_content`.
Posso fare OCR e poi CSV?
No. L'OCR restituisce Markdown. Questo strumento legge solo PDF tramite pdftotext.
In cosa differisce da PDF in Excel?
Lo stesso rilevamento. Excel scrive ogni tabella in un foglio della stessa cartella. CSV dà un file per tabella.
Legge ogni pagina?
Sì. pdftotext pagina per form-feed. Ogni pagina viene scansionata per blocchi tabella. Non c'è parametro di intervallo.

Ultimo aggiornamento:

Chiamalo dal codice

Ogni strumento del sito è un'interfaccia REST. Per l'uso anonimo non servono account né chiave API. Va bene per browser, sviluppatori e agenti IA.

curl -X POST "https://pdf123.xyz/api/v1/convert/pdf/csv" \
  -F "[email protected]" \
  -F "pageNumbers=all" \
  -o output.pdf

Disponibile anche come strumento MCP per i client che parlano Model Context Protocol (JSON-RPC 2.0 su POST /mcp). Riferimento API completo

Usalo da un agente IA

Skill

Con questa skill, Claude Code, Codex, Cursor e altri agenti IA possono eseguire «PDF in CSV» al posto tuo: /skills/pdf123-pdf-to-csv.md

Tutte le skill per agenti

I file servono solo a questa elaborazione e poi vengono cancellati.