Konvertera PDF-tabeller till Excel
PDF till Excel hittar justerade tabellrader i en PDF:s text och skriver varje tabell till ett eget blad i en .xlsx-arbetsbok. Den kräver textlager och ger inget för löptext eller skannade sidor.
Dra filer hit, eller klicka för att välja
Tar emot PDF · upp till 500.0 MB per fil · upp till 20 filer åt gången
Du kan också klistra in en fil med Ctrl/Cmd+V eller via urklippsmenyn.
PDF till Excel kör `pdftotext -layout`, letar rader med två eller fler mellanslag i följd och skriver de raderna till en `.xlsx`-arbetsbok. Varje hittad tabell blir ett blad med namn `Page N` eller `Page N Table M`. Passar digitala PDF:er där kolumnerna redan syns i utdragen text.
En tabell kräver minst två tabelliknande rader i följd. Brödtext, en ensam rubrikrad eller en skanning utan textlager ger `no_content`: ingen arbetsbok. Den tomma responsen är avsiktlig, inte ett tyst fel.
Verktyget ignorerar request-parametrar. Den här sidan har inget sidintervallfält. Kolumner klipps vid två eller fler mellanslag i följd; ensamma mellanslag inne i en cell stannar i cellen.
Det här är ingen OCR. Ren bildskanning har inget för `pdftotext` att läsa. Webbplatsens OCR returnerar Markdown och kan inte skickas vidare till PDF till Excel. Finns texten bara som pixlar får du inget kalkylark här.
PDF till CSV använder samma layoutheuristik. En tabell blir en CSV; flera tabeller blir en ZIP med CSV-filer. Excel lägger tabellerna som blad i samma arbetsbok. Ingen av dem återställer sammanslagna celler, färgade rubriker eller dolda blad från PDF:en.
Öppna nedladdningen i Excel eller LibreOffice Calc och stickprovsgranska kolumnklippningen. Täta tabeller utan dubbelmellanslagsluckor hamnar ofta i en kolumn. Lösenordsskyddade filer låses upp åt dig på den här sidan när du anger lösenordet; API-anropare kör Ta bort lösenord först.
Regeln med två mellanslag är hela detekteringsmekanismen, så arbetsbokens kvalitet beror helt på hur PDF:en sattes. Tabeller från rapportgeneratorer som fyller varje cell till fast bredd extraheras rent. Tabeller med bara ett mellanslag mellan kolumnerna, eller med proportionella typsnitt som lägger kolumnerna nästan intill varandra, registreras inte alls som tabeller och kan ge ingen arbetsbok. Innan du skyller på verktyget, markera en rad i PDF:en och bekräfta att texten över huvud taget går att markera.
Bladnamnen följer positionen, inte innehållet. Varje hittat block blir `Page N` eller `Page N Table M`, i den ordning sidorna skannas. En rapport med en tabell per sida ger ett blad per sida; en sida med tre staplade tabeller ger tre numrerade blad. Det finns inget alternativ att namnge blad efter en rubrikcell, och ingen sammanslagen utdata i ett enda blad.
Värden skrivs som text, exakt som de visades i den layoutbevarande extraktionen. Tal omvandlas inte till numeriska celler, så inledande nollor bevaras och valutasymboler och tusentalsavgränsare stannar i strängen. Det är oftast vad du vill för kontonummer och postnummer, och lite irriterande för en kolumn med belopp du tänker summera. Konvertera typerna i kalkylarket, eller kopiera kolumnen och använd text till kolumner eller värdekonvertering i målprogrammet.
Rader dubblettrensas inte och upprepade rubriker tas inte bort. När en tabell bryts vid en sidgräns upprepas rubrikraden ofta på nästa sida och fortsättningen blir ett eget blad. Sammanslagna celler återskapas inte; en cell som spände över två kolumner i PDF:en har helt enkelt texten i den vänstra kolumnen medan den högra är tom. Flerradiga celler blir separata rader i stället för ett radbrytet värde.
Uppladdningar är tillfälliga. Vi sparar ingen arbetsbokskatalog.
Funktioner
- `pdftotext -layout` plus dubbelmellanslagsheuristik för kolumner
- Ett blad per hittad tabell; ingen fil om inget upptäcks
- Ingen OCR; OCR-Markdown kan inte skickas hit
- Celler av texttyp; ingen typinferens eller återskapning av sammanslagna celler
- Anonym API: /api/v1/convert/pdf/xlsx
När du ska använda det här verktyget
- Öppna utdragna tabeller direkt i Excel eller LibreOffice Calc
- Dra in fakturatabeller från digital PDF till en arbetsbok
- Få tabeller från flera sidor som egna blad i stället för CSV
- Extrahera en finansiell rapport med fast bredd för vidare analys
Hur konverterar jag en PDF-tabell till Excel?
- Ladda upp en PDF som redan har markerbar text i tabelliknande kolumner.
- Klicka på Bearbeta. Det finns varken sidintervall eller OCR-alternativ.
- Hittades tabeller, ladda ner `.xlsx`. Annars får du tom framgång; prova en källa med textlager.
- Öppna arbetsboken och kontrollera klippningen. Ren brödtext-PDF ger inga blad.
Gränser och specialfall
- Kräver markerbar text och dubbelmellanslag mellan kolumner
- Ingen OCR och ingen sidintervallkontroll
- Sammanslagna celler och stil återskapas inte
- Alla värden är text; ingen numerisk eller datumtypning
- Tabeller över flera sidor blir separata blad
- Uppladdningsgräns på webbplatsen: 500 MB per fil, som skickas i delar över cirka 95 MB. Innehållet i en enskild direkt API-förfrågan är begränsat till 100 MB.
Exempel
- En text-PDF med trespalts prislista blir ofta ett blad med de kolumnerna
- En skannad bankavi utan textlager returnerar ingen arbetsbok
- En tio sidor lång rapport med en tabell per sida ger tio blad från Page 1 till Page 10
Integritet för det här verktyget
Filer laddas upp via HTTPS, bearbetas i serverns minne eller en kortlivad tillfällig katalog och raderas när resultatet är klart. Vi behåller inga kopior för senare bläddring, träning eller annonsprofiler. Se integritetspolicyn för lagringstider och AdSense-cookieupplysningar.
Vanliga frågor
- Varför fick jag inget kalkylark?
- Inget block med två eller fler tabellrader i följd hittades. Skanningar, brödtext och tabeller utan dubbelmellanslagsluckor får heuristiken att misslyckas.
- Kan jag OCR:a först och sedan konvertera till Excel?
- Nej. OCR returnerar Markdown. Det här verktyget läser bara PDF via pdftotext.
- Vad skiljer mot PDF till CSV?
- Samma detektion. Excel skriver varje tabell till ett eget blad i samma arbetsbok. CSV ger en fil per tabell (en CSV, eller ZIP vid flera).
- Läses varje sida?
- Ja. pdftotext delar på sidbrytningar. Varje sida genomsöks efter tabellblock. Det finns ingen sidintervallparameter.
- Varför sparas mina tal som text?
- Värden skrivs precis som de extraherades, så inledande nollor och formatering bevaras. Konvertera kolumnen till numerisk i kalkylarket om du behöver räkna med den.
- Återskapas sammanslagna celler?
- Nej. En sammanslagen cells text hamnar i den vänstra kolumnen och övriga kolumner är tomma. Flerradiga celler blir separata rader i stället för ett radbrytet värde.
- Varför får jag flera blad för en enda tabell?
- En tabell som fortsätter på en ny sida upptäcks igen där och blir ett till blad. Rubrikrader upprepas ofta; verktyget slår inte ihop fragmenten.
Senast uppdaterad:
Anropa från kod
Varje verktyg på webbplatsen är ett vanligt REST-anrop. För anonym användning behövs varken konto eller API-nyckel. Lika mycket för AI-agenter och utvecklare som för webbläsaren.
curl -X POST "https://pdf123.xyz/api/v1/convert/pdf/xlsx" \
-F "[email protected]" \
-o output.pdfFinns också som MCP-verktyg för klienter som talar Model Context Protocol (JSON-RPC 2.0 via POST /mcp). Fullständig API-referens
Använd den från en AI-agent
SkillMed den här skillen kan Claude Code, Codex, Cursor och andra AI-agenter köra ”PDF till Excel” åt dig: /skills/pdf123-pdf-to-xlsx.md
Filerna används bara för den här körningen och raderas automatiskt efteråt.