Naar de hoofdinhoud
PPDF123

PDF-tabellen omzetten naar Excel

PDF naar Excel vindt uitgelijnde tabelrijen in de tekst van een PDF en schrijft elke tabel naar een eigen werkblad van een .xlsx-werkmap. Het heeft een tekstlaag nodig en levert niets op voor lopende tekst of gescande pagina’s.

Sleep bestanden hierheen, of klik om te kiezen

Accepteert PDF · tot 500.0 MB per bestand · maximaal 20 bestanden tegelijk

Je kunt een bestand ook plakken met Ctrl/Cmd+V of via het klembordmenu.

PDF naar Excel draait `pdftotext -layout`, zoekt regels met twee of meer opeenvolgende spaties, en schrijft die regels naar een `.xlsx`-werkmap. Elke gedetecteerde tabel wordt een werkblad genaamd `Page N` of `Page N Table M`. Geschikt voor digitale PDF’s waarvan de kolommen in de geëxtraheerde tekst al uitgelijnd staan.

Een tabel heeft minstens twee opeenvolgende regels die als tabel ogen. Proza, één enkele kopregel, of scans zonder tekstlaag leveren `no_content`: geen werkmap. Een leeg resultaat is bewust, geen stille fout.

Dit gereedschap negeert verzoekparameters. Er is geen paginabereikveld op deze pagina. Kolommen worden gesneden op twee of meer opeenvolgende spaties; enkele spaties binnen een cel blijven in de cel.

Dit is geen OCR. Pure beeldscans hebben niets dat `pdftotext` kan lezen. OCR op deze site levert Markdown die u niet opnieuw naar PDF naar Excel kunt sturen. Als woorden alleen in pixels bestaan, komt hier geen spreadsheet uit.

PDF naar CSV gebruikt dezelfde lay-outheuristiek. Eén tabel wordt één CSV; meerdere tabellen worden een ZIP met CSV’s. Excel zet die tabellen op aparte werkbladen in één werkmap. Geen van beide herstelt samengevoegde cellen, gekleurde koppen of verborgen bladen uit de PDF.

Open de download in Excel of LibreOffice Calc en controleer enkele rijen op kolomsnede. Strakke tabellen zonder dubbele spaties vallen vaak in één kolom. Wachtwoordbeveiligde bestanden worden op deze pagina voor u ontgrendeld zodra u het wachtwoord invoert; API-gebruikers voeren eerst Wachtwoord verwijderen uit.

De regel van twee spaties is het hele detectiemechanisme, dus de kwaliteit van de werkmap hangt volledig af van hoe de PDF is opgemaakt. Tabellen van rapportgeneratoren die elke cel op een vaste breedte opvullen, worden schoon geëxtraheerd. Tabellen met slechts één spatie tussen kolommen, of met proportionele lettertypen die kolommen bijna tegen elkaar plaatsen, worden helemaal niet als tabel herkend en leveren mogelijk geen werkmap op. Voordat u het gereedschap de schuld geeft, selecteert u een regel in de PDF en controleert u of de tekst überhaupt selecteerbaar is.

Bladnamen volgen de positie, niet de inhoud. Elk gedetecteerd blok wordt `Page N` of `Page N Table M`, in de volgorde waarin pagina’s worden gescand. Een rapport met één tabel per pagina levert één werkblad per pagina op; een pagina met drie gestapelde tabellen levert drie genummerde bladen. Er is geen optie om bladen naar een kopcel te vernoemen, en er is geen samengevoegde uitvoer in één blad.

Waarden worden als tekst weggeschreven, precies zoals ze in de lay-outgetrouwe extractie verschenen. Getallen worden niet naar numerieke cellen omgezet, dus voorloopnullen blijven bewaard en valutasymbolen en duizendtalscheiders blijven in de tekenreeks staan. Dat is meestal wat u wilt voor rekeningnummers en postcodes, en licht vervelend voor een kolom met bedragen die u wilt optellen. Converteer de typen in de spreadsheet, of kopieer de kolom en gebruik tekst naar kolommen of waardeconversie van het doelprogramma.

Rijen worden niet ontdubbeld en herhaalde koppen worden niet verwijderd. Wanneer een tabel over een paginagrens breekt, herhaalt de kopregel zich vaak op de volgende pagina en het vervolg wordt een eigen blad. Samengevoegde cellen worden niet gereconstrueerd; een cel die in de PDF twee kolommen overspande, heeft de tekst alleen in de meest linkse kolom, de rechterkolom blijft leeg. Cellen met meerdere regels worden aparte rijen in plaats van één afgebroken waarde.

Uploads zijn tijdelijk. Wij bewaren geen bibliotheek van uw werkboeken.

Functies

  • `pdftotext -layout` plus heuristiek op dubbele spaties voor kolommen
  • Eén werkblad per gedetecteerde tabel; leeg resultaat levert geen bestand
  • Geen OCR; OCR-Markdown kan hierheen niet
  • Cellen van het type tekst; geen type-inferentie of reconstructie van samengevoegde cellen
  • Anonieme API: /api/v1/convert/pdf/xlsx

Wanneer je dit gebruikt

  • Geëxtraheerde tabellen direct in Excel of LibreOffice Calc openen
  • Digitale factuurtabellen in een werkmap trekken
  • Tabellen over meerdere pagina’s als aparte werkbladen i.p.v. één CSV
  • Een financiële staat met vaste breedte extraheren voor verdere analyse

Hoe zet ik een PDF-tabel om naar Excel?

  1. Voeg een PDF toe met selecteerbare tekst in tabelachtige kolommen.
  2. Klik op Verwerken. Er is geen paginabereik of OCR-optie.
  3. Zijn er tabellen gevonden, haal het `.xlsx` op. Zo niet, krijgt u een lege success; probeer een bron met tekstlaag.
  4. Open de werkmap en controleer de snede. Pure proza-PDF’s leveren geen werkbladen.

Beperkingen en randgevallen

  • Vereist selecteerbare tekst en kolomruimte met dubbele spaties
  • Geen OCR en geen paginabereikbesturing
  • Samengevoegde cellen en opmaak worden niet gereconstrueerd
  • Alle waarden zijn tekst; geen numerieke of datumtypering
  • Tabellen over meerdere pagina’s worden aparte bladen
  • Uploadlimiet op deze website: 500 MB per bestand, in delen verzonden boven ongeveer 95 MB. Eén directe API-aanvraag is beperkt tot 100 MB.

Voorbeelden

  • Een tekst-PDF met een prijslijst in drie kolommen wordt vaak één werkblad met die kolommen.
  • Een gescand bankafschrift zonder tekstlaag levert geen werkmap
  • Een rapport van tien pagina’s met één tabel per pagina levert tien bladen van Page 1 tot Page 10

Privacy bij deze tool

Bestanden gaan via HTTPS naar de server, worden in het geheugen of een kortlevende tijdelijke map verwerkt, en gewist zodra uw resultaat klaar is. Wij bewaren geen kopieën voor later bladeren, training of advertentieprofielen. Bewaartermijnen en AdSense-cookiemeldingen staan in het privacybeleid.

Veelgestelde vragen

Waarom kreeg ik geen spreadsheet?
Er is geen blok van twee of meer opeenvolgende tabelregels gevonden. Scans, proza en tabellen zonder dubbele spaties laten deze heuristiek falen.
Kan ik eerst OCR doen en daarna naar Excel converteren?
Nee. OCR levert Markdown. Dit gereedschap leest alleen PDF via pdftotext.
Wat verschilt van PDF naar CSV?
De detectie is gelijk. Excel schrijft elke tabel naar een eigen werkblad in één werkmap. CSV maakt per tabel een bestand (één CSV, of een ZIP bij meerdere).
Wordt elke pagina gelezen?
Ja. pdftotext pagineert op formfeeds. Elke pagina wordt op tabelblokken gescand. Er is geen paginabereikparameter.
Waarom worden mijn getallen als tekst opgeslagen?
Waarden worden precies zo weggeschreven als ze zijn geëxtraheerd, zodat voorloopnullen en opmaak behouden blijven. Converteer de kolom in de spreadsheet naar numeriek als u ermee wilt rekenen.
Worden samengevoegde cellen gereconstrueerd?
Nee. De tekst van een samengevoegde cel komt in de meest linkse kolom, de andere kolommen blijven leeg. Cellen met meerdere regels worden aparte rijen in plaats van één afgebroken waarde.
Waarom heb ik meerdere bladen voor één tabel?
Een tabel die doorloopt op een nieuwe pagina wordt daar opnieuw gedetecteerd en wordt een ander blad. Kopregels herhalen zich vaak; het gereedschap voegt de fragmenten niet samen.

Laatst bijgewerkt:

Aanroepen vanuit code

Elke tool op deze site is een gewoon REST-eindpunt. Voor anoniem gebruik heb je geen account of API-sleutel nodig. Net zo goed voor AI-agenten en ontwikkelaars als voor de browser.

curl -X POST "https://pdf123.xyz/api/v1/convert/pdf/xlsx" \
  -F "[email protected]" \
  -o output.pdf

Ook beschikbaar als MCP-tool voor clients die Model Context Protocol spreken (JSON-RPC 2.0 via POST /mcp). Volledige API-documentatie

Gebruik het vanuit een AI-agent

Skill

Met deze skill kunnen Claude Code, Codex, Cursor en andere AI-agents ‘PDF naar Excel’ voor je uitvoeren: /skills/pdf123-pdf-to-xlsx.md

Alle agent-skills

Bestanden dienen alleen voor deze verwerking en worden daarna automatisch verwijderd.