Konwersja tabel PDF na Excel
PDF na Excel znajduje wyrównane wiersze tabel w tekście PDF i zapisuje każdą tabelę w osobnym arkuszu skoroszytu .xlsx. Wymaga warstwy tekstu i nic nie zwraca dla zwykłego tekstu ani zeskanowanych stron.
Przeciągnij pliki tutaj albo kliknij, żeby wybrać
Obsługiwane: PDF · do 500.0 MB na plik · maks. 20 plików naraz
Możesz też wkleić plik przez Ctrl/Cmd+V lub z menu schowka.
Konwersja PDF na Excel uruchamia `pdftotext -layout`, szuka wierszy z dwoma lub więcej spacjami pod rząd i zapisuje je do skoroszytu `.xlsx`. Każda wykryta tabela staje się arkuszem `Page N` lub `Page N Table M`. Nadaje się do elektronicznych PDF, w których kolumny są już wyrównane w wyciągniętym tekście.
Tabela wymaga co najmniej dwóch kolejnych wierszy tabelarycznych. Proza, samotny wiersz nagłówka albo skan bez warstwy tekstu dają `no_content`: bez skoroszytu. Pusty wynik jest zamierzony, nie cichą awarią.
Narzędzie ignoruje parametry żądania. Na tej stronie nie ma pola zakresu stron. Kolumny tną się na dwóch lub więcej spacjach z rzędu; pojedyncze spacje w komórce zostają w komórce.
To nie OCR. Czysty skan obrazowy nie ma treści dla `pdftotext`. OCR na tej stronie zwraca Markdown i nie da się go tu włożyć. Gdy tekst istnieje tylko w pikselach, arkusza nie będzie.
PDF na CSV używa tej samej heurystyki układu. Jedna tabela → jeden CSV; wiele → ZIP z CSV. Excel kładzie te tabele na arkuszach jednego skoroszytu. Żadne nie odtwarza scalonych komórek, kolorowych nagłówków ani ukrytych arkuszy z PDF.
Otwórz pobranie w Excelu lub LibreOffice Calc i sprawdź kilka wierszy pod kątem cięcia kolumn. Ścisłe tabele bez podwójnych spacji często wpadają do jednej kolumny. Pliki chronione hasłem są odblokowywane za Ciebie na tej stronie, gdy tylko wpiszesz hasło; wywołujący API najpierw uruchamiają Usuń hasło.
Reguła dwóch spacji to cały mechanizm wykrywania, więc jakość skoroszytu zależy wyłącznie od tego, jak złożono PDF. Tabele z generatorów raportów, które dopełniają każdą komórkę do stałej szerokości, wyciągają się czysto. Tabele z pojedynczą spacją między kolumnami albo z czcionką proporcjonalną, która stawia kolumny niemal obok siebie, wcale nie są rozpoznawane jako tabele i mogą nie dać skoroszytu. Zanim obwinisz narzędzie, zaznacz wiersz w PDF i sprawdź, czy tekst w ogóle da się zaznaczyć.
Nazwy arkuszy wynikają z pozycji, nie z treści. Każdy wykryty blok staje się `Page N` lub `Page N Table M`, w kolejności skanowania stron. Raport z jedną tabelą na stronie daje jeden arkusz na stronę; strona z trzema tabelami jedna pod drugą daje trzy numerowane arkusze. Nie ma opcji nazywania arkuszy od komórki nagłówka ani scalonego wyjścia w jednym arkuszu.
Wartości są zapisywane jako tekst, dokładnie tak, jak pojawiły się w wyciągu zachowującym układ. Liczby nie są zamieniane na komórki liczbowe, więc wiodące zera przetrwają, a symbole walut i separatory tysięcy zostają w ciągu. To zwykle pożądane przy numerach kont i kodach pocztowych, a nieco irytujące przy kolumnie kwot, które chcesz sumować. Przekonwertuj typy w arkuszu albo skopiuj kolumnę i użyj tekstu jako kolumn lub konwersji wartości w programie docelowym.
Wiersze nie są deduplikowane, a powtarzające się nagłówki nie są usuwane. Gdy tabela łamie się na granicy strony, wiersz nagłówka często powtarza się na następnej stronie, a kontynuacja staje się osobnym arkuszem. Scalane komórki nie są odtwarzane; komórka, która w PDF zajmowała dwie kolumny, ma po prostu tekst w skrajnej lewej kolumnie, a prawa pozostaje pusta. Komórki wielowierszowe stają się osobnymi wierszami, a nie jedną zawiniętą wartością.
Przesłania są tymczasowe. Nie prowadzimy biblioteki Twoich skoroszytów.
Funkcje
- `pdftotext -layout` plus heurystyka kolumn na podwójnych spacjach
- Jeden arkusz na wykrytą tabelę; przy pustym wykryciu bez pliku
- Bez OCR; Markdown z OCR nie wchodzi tutaj
- Komórki tekstowe; bez wnioskowania typów i odtwarzania scalonych komórek
- Anonimowe API: /api/v1/convert/pdf/xlsx
Kiedy tego użyć
- Otworzyć wyciągnięte tabele od razu w Excelu lub LibreOffice Calc
- Wciągnąć elektroniczną tabelę faktury do skoroszytu
- Mieć tabele z wielu stron jako arkusze zamiast jednego CSV
- Wyciągnąć zestawienie finansowe o stałej szerokości do dalszej analizy
Jak zamienić tabelę z PDF na Excel?
- Prześlij PDF z zaznaczalnym tekstem i kolumnami w układzie tabeli.
- Kliknij Przetwórz. Nie ma zakresu stron ani opcji OCR.
- Jeśli znaleziono tabele, pobierz `.xlsx`. Jeśli nie — puste powodzenie; spróbuj źródła z warstwą tekstu.
- Otwórz skoroszyt i sprawdź cięcie. Czysta proza nie da arkuszy.
Ograniczenia i przypadki brzegowe
- Wymaga zaznaczalnego tekstu i luki kolumn na podwójnych spacjach
- Bez OCR i bez kontroli zakresu stron
- Scalone komórki i styl nie są odtwarzane
- Wszystkie wartości to tekst; brak typowania liczb i dat
- Tabele przechodzące przez strony stają się osobnymi arkuszami
- Limit przesyłania na tej stronie: 500 MB na plik, wysyłane porcjami powyżej około 95 MB. Treść pojedynczego bezpośredniego żądania API jest ograniczona do 100 MB.
Przykłady
- Tekstowy PDF z trójkolumnowym cennikiem często staje się jednym arkuszem tych kolumn
- Zeskanowany wyciąg bankowy bez warstwy tekstu nie zwraca skoroszytu
- Raport dziesięciostronicowy z jedną tabelą na stronę daje dziesięć arkuszy od Page 1 do Page 10
Prywatność tego narzędzia
Pliki są przesyłane przez HTTPS, przetwarzane w pamięci lub w krótkotrwałym katalogu tymczasowym na naszych serwerach i usuwane, gdy wynik jest gotowy. Nie przechowujemy kopii do późniejszego przeglądania, trenowania ani profili reklamowych. Szczegóły retencji i pliki cookie AdSense znajdują się w polityce prywatności.
Najczęstsze pytania
- Dlaczego nie dostałem arkusza?
- Nie znaleziono bloku dwóch lub więcej kolejnych wierszy tabelarycznych. Skany, proza i tabele bez podwójnych spacji zawodzą tę heurystykę.
- Czy mogę najpierw OCR, a potem konwersję na Excel?
- Nie. OCR zwraca Markdown. To narzędzie czyta PDF tylko przez pdftotext.
- Czym różni się od PDF na CSV?
- Wykrywanie jest to samo. Excel zapisuje każdą tabelę na osobnym arkuszu jednego skoroszytu. CSV daje jeden plik na tabelę (jeden CSV albo ZIP przy wielu).
- Czy czyta każdą stronę?
- Tak. pdftotext dzieli po znakach nowej strony. Każda strona jest skanowana pod bloki tabel. Nie ma parametru zakresu stron.
- Dlaczego moje liczby są zapisywane jako tekst?
- Wartości są zapisywane dokładnie tak, jak je wyciągnięto, więc wiodące zera i formatowanie przetrwają. Przekonwertuj kolumnę na liczbową w arkuszu, jeśli chcesz na niej liczyć.
- Czy scalone komórki są odtwarzane?
- Nie. Tekst scalonej komórki trafia do skrajnej lewej kolumny, a pozostałe są puste. Komórki wielowierszowe stają się osobnymi wierszami, a nie jedną zawiniętą wartością.
- Dlaczego mam kilka arkuszy dla jednej tabeli?
- Tabela, która przechodzi na nową stronę, jest tam wykrywana ponownie i staje się kolejnym arkuszem. Wiersze nagłówka często się powtarzają; narzędzie nie scala fragmentów.
Ostatnia aktualizacja:
Wywołanie z kodu
Każde narzędzie na stronie to zwykły interfejs REST. Anonimowo nie trzeba konta ani klucza API. Działa w przeglądarce, u programistów i u agentów AI.
curl -X POST "https://pdf123.xyz/api/v1/convert/pdf/xlsx" \
-F "[email protected]" \
-o output.pdfDostępne też jako narzędzie MCP dla klientów mówiących Model Context Protocol (JSON-RPC 2.0, POST /mcp). Pełna dokumentacja API
Użyj go z agentem AI
SkillZ tym skillem Claude Code, Codex, Cursor i inne agenty AI mogą wykonać za Ciebie „PDF na Excel”: /skills/pdf123-pdf-to-xlsx.md
Pliki służą tylko do tego zadania i są potem automatycznie usuwane.