Към основното съдържание
PPDF123

Превърнете таблици от PDF в Excel

PDF към Excel намира подравнени редове на таблици в текста на PDF и записва всяка таблица в отделен лист на .xlsx работна книга. Изисква текстов слой и не връща нищо за проза или сканирани страници.

Плъзнете файлове тук или кликнете, за да изберете

Приема PDF · до 500.0 MB на файл · до 20 файла наведнъж

Можете също да поставите файл с Ctrl/Cmd+V или от менюто на клипборда.

PDF към Excel пуска `pdftotext -layout`, търси редове с два или повече последователни интервала и ги записва в `.xlsx` работна книга. Всяка открита таблица става лист с име `Page N` или `Page N Table M`. Подходящо за електронни PDF с вече подравнени колони в извлечения текст.

Таблицата трябва да има поне два последователни реда, приличащи на таблица. Проза, само един ред заглавие или скан без текст слой дават `no_content`: без работна книга. Празният резултат е умишлен, не тих провал.

Инструментът игнорира параметрите на заявката. На страницата няма поле за диапазон страници. Колоните се режат по два или повече последователни интервала; единичните интервали в клетката остават.

Това не е OCR. Чисто изображенните сканове нямат съдържание за `pdftotext`. «OCR към Markdown» връща Markdown и не може да се подаде тук. Когато думите са само в пиксели, тук няма електронна таблица.

«PDF към CSV» ползва същата евристика. Една таблица става един CSV; няколко — ZIP с CSV. Excel слага тези таблици в отделни листове на една книга. Нито едното не възстановява обединени клетки, цветни заглавия или скрити листове.

Отворете изтеглянето в Excel или LibreOffice Calc и проверете няколко реда. Плътни таблици без двойни интервали често падат в една колона. Файловете, защитени с парола, се отключват вместо вас на тази страница, щом въведете паролата; при API първо пуснете «Премахване на парола».

Качванията са временни. Не пазим библиотека с работни книги.

Възможности

  • `pdftotext -layout` плюс евристика с двойни интервали
  • По лист на открита таблица; празно откриване — без файл
  • Не е OCR; Markdown от OCR не се подава тук
  • Анонимен API: /api/v1/convert/pdf/xlsx

Кога да го използвате

  • Извлечени таблици директно в Excel или Calc
  • Електронна фактурна таблица в работна книга
  • По лист на таблица от много страници вместо един CSV

Как да превърна таблица от PDF в Excel?

  1. Качете PDF с избираем текст и таблично подравнени колони.
  2. Стартирайте обработката. Няма диапазон страници или OCR опция.
  3. При намерени таблици изтеглете `.xlsx`. При никакви — празен успех; сменете източника с текст слой.
  4. Отворете книгата и проверете разреза. Чиста проза не дава листове.

Ограничения и крайни случаи

  • Иска избираем текст и двойни интервали между колони
  • Без OCR и без контрол за диапазон страници
  • Не възстановява обединени клетки и стилове
  • Ограничение за качване на този сайт: 500 MB на файл; над около 95 MB файлът се изпраща на части. Тялото на една пряка API заявка е ограничено до 100 MB.

Примери

  • Текстов PDF с триколонна ценова листа често става лист с тези колони
  • Сканирано банково извлечение без текст слой не връща книга

Поверителност при този инструмент

Файловете се качват по HTTPS, обработват се в паметта или в краткоживуща временна директория на нашите сървъри и се изтриват, щом резултатът е готов. Не задържаме копия за по-късен преглед, обучение на модели или рекламни профили. Сроковете за съхранение и обясненията за бисквитките на AdSense са в Политиката за поверителност.

Често задавани въпроси

Защо няма електронна таблица?
Не са намерени два или повече последователни таблични реда. Сканове, проза и таблици без двойни интервали провалят евристиката.
Мога ли първо OCR, после Excel?
Не. OCR връща Markdown. Този инструмент чете PDF само през pdftotext.
Каква е разликата с PDF към CSV?
Откриването е същото. Excel пише всяка таблица в отделен лист на една книга. CSV е по файл на таблица (една — един CSV; няколко — ZIP).
Чете ли всяка страница?
Да. pdftotext разделя по form feed. Всяка страница се сканира за таблични блокове. Няма параметър за диапазон.

Последна актуализация:

Извикване от код

Всеки инструмент е обикновен REST интерфейс. За анонимна употреба не трябват профил или API ключ. Работи еднакво в браузър, за разработчици и за AI агенти.

curl -X POST "https://pdf123.xyz/api/v1/convert/pdf/xlsx" \
  -F "[email protected]" \
  -o output.pdf

Наличен е и като MCP инструмент за клиенти с Model Context Protocol (JSON-RPC 2.0 през POST /mcp). Пълна API документация

Използвайте го чрез AI агент

Скил

С този скил Claude Code, Codex, Cursor и други AI агенти могат да изпълнят „PDF към Excel“ вместо вас: /skills/pdf123-pdf-to-xlsx.md

Всички скилове за агенти

Файловете служат само за тази обработка и после се изтриват автоматично.