Tabellen uit een PDF naar CSV halen
PDF naar CSV vindt uitgelijnde tabelrijen in de tekst van een PDF en schrijft elke gevonden tabel als CSV-bestand; meerdere tabellen komen terug in een ZIP. Het heeft een tekstlaag nodig en levert niets op voor lopende tekst of scans.
Sleep bestanden hierheen, of klik om te kiezen
Accepteert PDF · tot 500.0 MB per bestand · maximaal 20 bestanden tegelijk
Je kunt een bestand ook plakken met Ctrl/Cmd+V of via het klembordmenu.
PDF naar CSV voert `pdftotext -layout` uit, zoekt regels met twee of meer opeenvolgende spaties, en schrijft die rijen als CSV. Elke gevonden tabel wordt `{base}_pN_tM.csv`. Bedoeld voor elektronisch gemaakte PDF’s waarvan de kolommen in de geëxtraheerde tekst al uitlijnen.
Een tabel heeft minstens twee opeenvolgende tabelachtige regels nodig. Proza, één enkele kopregel, of een scan zonder tekstlaag levert `no_content`: HTTP 204, geen bestand. Dat lege resultaat is opzet, geen stille fout.
Dit gereedschap negeert requestparameters. Het paginabereikveld op deze pagina wordt niet gelezen; elke pagina wordt gescand. Eén tabel wordt `text/csv`; meerdere tabellen een ZIP `{base}_extracted.zip`. Kolommen splitsen op twee of meer opeenvolgende spaties; enkele spaties binnen een cel blijven. Velden krijgen RFC 4180-aanhalingstekens.
Dit is geen OCR. Pure beeldscans hebben niets voor `pdftotext`. OCR naar Markdown geeft Markdown die hier niet opnieuw in kan. Bestaan de woorden alleen als pixels, dan krijgt u hier geen tabelbestanden.
PDF naar Excel gebruikt dezelfde lay-outheuristiek. Excel zet tabellen als werkbladen in één werkmap. CSV is één bestand per tabel. Geen van beide herstelt samengevoegde cellen, gekleurde koppen of verborgen bladen.
Open de download in Excel of LibreOffice Calc en controleer een paar rijen. Dichte tabellen zonder dubbele spaties vallen vaak in één kolom. Wachtwoordbeveiligde bestanden worden op deze pagina voor u ontgrendeld zodra u het wachtwoord invoert; API-gebruikers voeren eerst Wachtwoord verwijderen uit.
Uploads zijn tijdelijk. Wij bewaren geen CSV-bibliotheek.
Functies
- `pdftotext -layout` plus dubbele-spatie-kolomheuristiek
- Eén CSV per tabel; meerdere → ZIP; leeg → HTTP 204
- Geen OCR; OCR-Markdown kan hier niet naartoe
- Anonieme API: /api/v1/convert/pdf/csv
Wanneer je dit gebruikt
- Elektronische factuurtabellen naar Excel of LibreOffice Calc
- Tabellen over meerdere pagina’s als aparte CSV’s, niet één werkblad
- Invoer voor scripts die alleen CSV accepteren
Hoe haal ik een tabel uit een PDF naar CSV?
- Voeg een PDF met selecteerbare tekst waarvan de kolommen in extractietekst al zichtbaar zijn toe.
- Klik op Verwerken. Het paginabereikveld staat er, maar de converter leest het niet. Geen OCR-optie.
- Eén tabel → `.csv`. Meerdere → ZIP. Geen → lege success; wissel naar een bron met tekstlaag.
- Open in Excel of LibreOffice Calc en controleer de splitsing. Pure proza-PDF’s leveren geen bestand.
Beperkingen en randgevallen
- Vereist selecteerbare tekst en dubbele-spatie-kolomruimte
- Geen OCR; paginabereik werkt niet
- Herstelt geen samengevoegde cellen of opmaak
- Uploadlimiet op deze website: 500 MB per bestand, in delen verzonden boven ongeveer 95 MB. Eén directe API-aanvraag is beperkt tot 100 MB.
Voorbeelden
- Een tekst-PDF met een prijslijst van drie kolommen wordt vaak één CSV met die kolommen
- Een gescand bankafschrift zonder tekstlaag → HTTP 204
Privacy bij deze tool
Bestanden worden via HTTPS geüpload, in het geheugen of in een kortlevende tijdelijke map op onze servers verwerkt, en verwijderd zodra uw resultaat klaar is. Wij bewaren geen kopieën voor later bladeren, training of advertentieprofielen. Zie het privacybeleid voor bewaartermijnen en AdSense-cookiemeldingen.
Veelgestelde vragen
- Waarom geen CSV?
- Er waren geen twee of meer opeenvolgende tabelregels. Scans, proza en tabellen zonder dubbele spaties laten deze heuristiek falen. De API antwoordt 204 `no_content`.
- Kan ik eerst OCR doen en dan naar CSV?
- Nee. OCR geeft Markdown. Dit gereedschap leest alleen PDF via pdftotext.
- Wat is het verschil met PDF naar Excel?
- Detectie is gelijk. CSV is één bestand per tabel (of ZIP). Excel schrijft elke tabel naar een werkblad in één werkmap.
- Wordt elke pagina gelezen?
- Ja. pdftotext pagineert op formfeed. Elke pagina wordt op tabelblokken gescand. Het paginabereikveld wordt niet gelezen.
Laatst bijgewerkt:
Aanroepen vanuit code
Elke tool op deze site is een gewoon REST-eindpunt. Voor anoniem gebruik heb je geen account of API-sleutel nodig. Net zo goed voor AI-agenten en ontwikkelaars als voor de browser.
curl -X POST "https://pdf123.xyz/api/v1/convert/pdf/csv" \
-F "[email protected]" \
-F "pageNumbers=all" \
-o output.pdfOok beschikbaar als MCP-tool voor clients die Model Context Protocol spreken (JSON-RPC 2.0 via POST /mcp). Volledige API-documentatie
Gebruik het vanuit een AI-agent
SkillMet deze skill kunnen Claude Code, Codex, Cursor en andere AI-agents ‘PDF naar CSV’ voor je uitvoeren: /skills/pdf123-pdf-to-csv.md
Bestanden dienen alleen voor deze verwerking en worden daarna automatisch verwijderd.