Перейти до основного вмісту
PPDF123

Перетворення таблиць PDF на Excel

PDF у Excel знаходить у тексті PDF вирівняні рядки таблиць і записує кожну таблицю на окремий аркуш книги .xlsx. Потрібен текстовий шар; для суцільного тексту чи сканованих сторінок нічого не виходить.

Перетягніть файли сюди або натисніть, щоб вибрати

Формати: PDF · до 500.0 MB на файл · до 20 файлів за раз

Файл також можна вставити через Ctrl/Cmd+V або з меню буфера обміну.

PDF у Excel запускає `pdftotext -layout`, шукає рядки з двома й більше пробілами поспіль і пише їх у книгу `.xlsx`. Кожна знайдена таблиця стає аркушем `Page N` або `Page N Table M`. Для електронних PDF із уже вирівняними колонками в тексті.

Таблиця потребує щонайменше двох підряд «табличних» рядків. Проза, один заголовок або скан без текстового шару дають `no_content`: без книги. Порожній результат навмисний, а не тихий збій.

Параметри запиту ігноруються. На цій сторінці немає поля діапазону сторінок. Колонки ріжуться за двома й більше пробілами; одинарні пробіли в комірці лишаються в комірці.

Це не OCR. Суто зображений скан не має вмісту для `pdftotext`. OCR на цьому сайті повертає Markdown, який не можна знову подати в PDF у Excel. Коли літери лише в пікселях, електронної таблиці не буде.

«PDF у CSV» використовує ту саму евристику верстки. Одна таблиця стає одним CSV; кілька — ZIP із CSV. Excel кладе ці таблиці аркушами однієї книги. Жоден із них не відновлює з PDF об’єднані комірки, кольорові заголовки чи приховані аркуші.

Відкрийте завантаження в Excel або LibreOffice Calc і перевірте розріз колонок на кількох рядках. Щільні таблиці без подвійних пробілів часто в одній колонці. Файли, захищені паролем, на цій сторінці розблоковуються за вас, щойно ви введете пароль; виклики через API спочатку виконують «Зняти пароль».

Правило двох пробілів — це весь механізм виявлення, тож якість книги повністю залежить від того, як набрано PDF. Таблиці з генераторів звітів, що доповнюють кожну комірку до фіксованої ширини, витягуються чисто. Таблиці з одним пробілом між колонками або з пропорційним шрифтом, який ставить колонки майже впритул, узагалі не розпізнаються як таблиці й можуть не дати книги. Перш ніж звинувачувати інструмент, виділіть рядок у PDF і переконайтеся, що текст узагалі виділяється.

Імена аркушів відповідають позиції, а не вмісту. Кожен виявлений блок стає `Page N` або `Page N Table M` у порядку сканування сторінок. Звіт з однією таблицею на сторінці дає по аркушу на сторінку; сторінка з трьома таблицями підряд дає три нумеровані аркуші. Немає ні опції називати аркуші за коміркою заголовка, ні об’єднаного виводу на одному аркуші.

Значення записуються як текст, точно як вони виглядали у витягу із збереженою версткою. Числа не перетворюються на числові комірки, тож провідні нулі зберігаються, а символи валют і розділювачі тисяч залишаються в рядку. Для номерів рахунків і поштових індексів це зазвичай те, що потрібно, а для колонки сум, які ви збираєтеся додавати, трохи заважає. Або перетворіть типи в таблиці, або скопіюйте колонку й скористайтеся «текст за стовпцями» чи перетворенням значень у цільовій програмі.

Рядки не дедуплікуються, а повторювані заголовки не видаляються. Коли таблиця розривається на межі сторінки, рядок заголовка часто повторюється на наступній сторінці, і продовження стає окремим аркушем. Об’єднані комірки не відновлюються; комірка, що займала в PDF дві колонки, просто має текст у найлівішій колонці, а права лишається порожньою. Багаторядкові комірки стають окремими рядками, а не одним перенесеним значенням.

Вивантаження тимчасові. Бібліотеки книг ми не зберігаємо.

Що вміє

  • `pdftotext -layout` плюс евристика подвійних пробілів
  • Один аркуш на знайдену таблицю; порожнє виявлення не повертає файл
  • Не OCR; Markdown з OCR сюди не подається
  • Комірки текстового типу; без виведення типів і відновлення об’єднаних комірок
  • Анонімний API: /api/v1/convert/pdf/xlsx

Коли брати цей інструмент

  • Витягнути таблиці звіту в Excel або LibreOffice Calc
  • Перенести таблицю електронної накладної в книгу
  • Тримати таблиці з кількох сторінок аркушами, а не одним CSV
  • Витягти фінансовий звіт фіксованої ширини для подальшого аналізу

Як перетворити таблицю PDF на Excel?

  1. Вивантажте PDF із виділюваним текстом і колонками у вигляді таблиці.
  2. Натисніть «Обробити». У цього інструмента немає ні діапазону сторінок, ні опцій OCR.
  3. Якщо таблиці знайдено, завантажте `.xlsx`. Якщо ні, ви отримаєте порожній успіх; візьміть джерело з текстовим шаром.
  4. Відкрийте книгу й перевірте розріз. Суто прозовий PDF аркушів не дасть.

Обмеження і межі

  • Потрібен виділюваний текст і проміжок колонок у два пробіли
  • Без OCR і без керування діапазоном сторінок
  • Об’єднані комірки й стилі не відновлюються
  • Усі значення — текст; без числового чи датового типу
  • Таблиці, що переходять через сторінки, стають окремими аркушами
  • Обмеження завантаження на цьому сайті: 500 МБ на файл; якщо файл більший за приблизно 95 МБ, він надсилається частинами. Тіло одного прямого запиту до API — не більше 100 МБ.

Приклади

  • Текстовий PDF із триколонковим прайсом часто стає аркушем цих колонок
  • Сканована банківська виписка без текстового шару не повертає книгу
  • Звіт на десять сторінок з однією таблицею на сторінці дає десять аркушів від Page 1 до Page 10

Приватність цього інструмента

Файли надсилаються через HTTPS, обробляються в оперативній пам’яті або в короткочасному тимчасовому каталозі на наших серверах і видаляються, щойно результат готовий. Копій для подальшого перегляду, навчання моделей чи рекламних профілів ми не зберігаємо. Строки зберігання та відомості про файли cookie AdSense наведені в Політиці конфіденційності.

Часті запитання

Чому я не отримав електронної таблиці?
Не знайдено блоку з двох і більше табличних рядків підряд. Скани, проза й таблиці без подвійних пробілів не проходять цю евристику.
Чи можна спершу OCR, а потім Excel?
Ні. OCR повертає Markdown. Цей інструмент читає PDF лише через pdftotext.
Чим це відрізняється від PDF у CSV?
Виявлення однакове. Excel пише кожну таблицю на окремий аркуш однієї книги. CSV — один файл на таблицю (один CSV або ZIP, якщо таблиць кілька).
Чи читаються всі сторінки?
Так. pdftotext ділить сторінки за form feed. На кожній шукаються табличні блоки. Параметра діапазону сторінок немає.
Чому мої числа зберігаються як текст?
Значення записуються точно як витягнуті, тож провідні нулі й форматування зберігаються. Перетворіть колонку на числову в таблиці, якщо хочете нею рахувати.
Чи відновлюються об’єднані комірки?
Ні. Текст об’єднаної комірки потрапляє в найлівішу колонку, а решта лишаються порожніми. Багаторядкові комірки стають окремими рядками, а не одним перенесеним значенням.
Чому для однієї таблиці кілька аркушів?
Таблиця, що продовжується на новій сторінці, виявляється там знову й стає ще одним аркушем. Рядки заголовків часто повторюються; інструмент не об’єднує фрагменти.

Востаннє оновлено:

Виклик із коду

Кожен інструмент на сайті - звичайний REST-інтерфейс. Для анонімної роботи не потрібні обліковий запис чи ключ API. І для браузера, і для розробників, і для програмних агентів.

curl -X POST "https://pdf123.xyz/api/v1/convert/pdf/xlsx" \
  -F "[email protected]" \
  -o output.pdf

Також є як MCP-інструмент для клієнтів із Model Context Protocol (JSON-RPC 2.0 через POST /mcp). Повний довідник API

Використати через ШІ-агента

Скіл

З цим скілом Claude Code, Codex, Cursor та інші ШІ-агенти зможуть виконати «PDF у Excel» замість вас: /skills/pdf123-pdf-to-xlsx.md

Усі скіли для агентів

Файли потрібні лише для цієї обробки й потім стираються самі.