Перетворення таблиць PDF на Excel
PDF у Excel знаходить у тексті PDF вирівняні рядки таблиць і записує кожну таблицю на окремий аркуш книги .xlsx. Потрібен текстовий шар; для суцільного тексту чи сканованих сторінок нічого не виходить.
Перетягніть файли сюди або натисніть, щоб вибрати
Формати: PDF · до 500.0 MB на файл · до 20 файлів за раз
Файл також можна вставити через Ctrl/Cmd+V або з меню буфера обміну.
PDF у Excel запускає `pdftotext -layout`, шукає рядки з двома й більше пробілами поспіль і пише їх у книгу `.xlsx`. Кожна знайдена таблиця стає аркушем `Page N` або `Page N Table M`. Для електронних PDF із уже вирівняними колонками в тексті.
Таблиця потребує щонайменше двох підряд «табличних» рядків. Проза, один заголовок або скан без текстового шару дають `no_content`: без книги. Порожній результат навмисний, а не тихий збій.
Параметри запиту ігноруються. На цій сторінці немає поля діапазону сторінок. Колонки ріжуться за двома й більше пробілами; одинарні пробіли в комірці лишаються в комірці.
Це не OCR. Суто зображений скан не має вмісту для `pdftotext`. OCR на цьому сайті повертає Markdown, який не можна знову подати в PDF у Excel. Коли літери лише в пікселях, електронної таблиці не буде.
«PDF у CSV» використовує ту саму евристику верстки. Одна таблиця стає одним CSV; кілька — ZIP із CSV. Excel кладе ці таблиці аркушами однієї книги. Жоден із них не відновлює з PDF об’єднані комірки, кольорові заголовки чи приховані аркуші.
Відкрийте завантаження в Excel або LibreOffice Calc і перевірте розріз колонок на кількох рядках. Щільні таблиці без подвійних пробілів часто в одній колонці. Файли, захищені паролем, на цій сторінці розблоковуються за вас, щойно ви введете пароль; виклики через API спочатку виконують «Зняти пароль».
Правило двох пробілів — це весь механізм виявлення, тож якість книги повністю залежить від того, як набрано PDF. Таблиці з генераторів звітів, що доповнюють кожну комірку до фіксованої ширини, витягуються чисто. Таблиці з одним пробілом між колонками або з пропорційним шрифтом, який ставить колонки майже впритул, узагалі не розпізнаються як таблиці й можуть не дати книги. Перш ніж звинувачувати інструмент, виділіть рядок у PDF і переконайтеся, що текст узагалі виділяється.
Імена аркушів відповідають позиції, а не вмісту. Кожен виявлений блок стає `Page N` або `Page N Table M` у порядку сканування сторінок. Звіт з однією таблицею на сторінці дає по аркушу на сторінку; сторінка з трьома таблицями підряд дає три нумеровані аркуші. Немає ні опції називати аркуші за коміркою заголовка, ні об’єднаного виводу на одному аркуші.
Значення записуються як текст, точно як вони виглядали у витягу із збереженою версткою. Числа не перетворюються на числові комірки, тож провідні нулі зберігаються, а символи валют і розділювачі тисяч залишаються в рядку. Для номерів рахунків і поштових індексів це зазвичай те, що потрібно, а для колонки сум, які ви збираєтеся додавати, трохи заважає. Або перетворіть типи в таблиці, або скопіюйте колонку й скористайтеся «текст за стовпцями» чи перетворенням значень у цільовій програмі.
Рядки не дедуплікуються, а повторювані заголовки не видаляються. Коли таблиця розривається на межі сторінки, рядок заголовка часто повторюється на наступній сторінці, і продовження стає окремим аркушем. Об’єднані комірки не відновлюються; комірка, що займала в PDF дві колонки, просто має текст у найлівішій колонці, а права лишається порожньою. Багаторядкові комірки стають окремими рядками, а не одним перенесеним значенням.
Вивантаження тимчасові. Бібліотеки книг ми не зберігаємо.
Що вміє
- `pdftotext -layout` плюс евристика подвійних пробілів
- Один аркуш на знайдену таблицю; порожнє виявлення не повертає файл
- Не OCR; Markdown з OCR сюди не подається
- Комірки текстового типу; без виведення типів і відновлення об’єднаних комірок
- Анонімний API: /api/v1/convert/pdf/xlsx
Коли брати цей інструмент
- Витягнути таблиці звіту в Excel або LibreOffice Calc
- Перенести таблицю електронної накладної в книгу
- Тримати таблиці з кількох сторінок аркушами, а не одним CSV
- Витягти фінансовий звіт фіксованої ширини для подальшого аналізу
Як перетворити таблицю PDF на Excel?
- Вивантажте PDF із виділюваним текстом і колонками у вигляді таблиці.
- Натисніть «Обробити». У цього інструмента немає ні діапазону сторінок, ні опцій OCR.
- Якщо таблиці знайдено, завантажте `.xlsx`. Якщо ні, ви отримаєте порожній успіх; візьміть джерело з текстовим шаром.
- Відкрийте книгу й перевірте розріз. Суто прозовий PDF аркушів не дасть.
Обмеження і межі
- Потрібен виділюваний текст і проміжок колонок у два пробіли
- Без OCR і без керування діапазоном сторінок
- Об’єднані комірки й стилі не відновлюються
- Усі значення — текст; без числового чи датового типу
- Таблиці, що переходять через сторінки, стають окремими аркушами
- Обмеження завантаження на цьому сайті: 500 МБ на файл; якщо файл більший за приблизно 95 МБ, він надсилається частинами. Тіло одного прямого запиту до API — не більше 100 МБ.
Приклади
- Текстовий PDF із триколонковим прайсом часто стає аркушем цих колонок
- Сканована банківська виписка без текстового шару не повертає книгу
- Звіт на десять сторінок з однією таблицею на сторінці дає десять аркушів від Page 1 до Page 10
Приватність цього інструмента
Файли надсилаються через HTTPS, обробляються в оперативній пам’яті або в короткочасному тимчасовому каталозі на наших серверах і видаляються, щойно результат готовий. Копій для подальшого перегляду, навчання моделей чи рекламних профілів ми не зберігаємо. Строки зберігання та відомості про файли cookie AdSense наведені в Політиці конфіденційності.
Часті запитання
- Чому я не отримав електронної таблиці?
- Не знайдено блоку з двох і більше табличних рядків підряд. Скани, проза й таблиці без подвійних пробілів не проходять цю евристику.
- Чи можна спершу OCR, а потім Excel?
- Ні. OCR повертає Markdown. Цей інструмент читає PDF лише через pdftotext.
- Чим це відрізняється від PDF у CSV?
- Виявлення однакове. Excel пише кожну таблицю на окремий аркуш однієї книги. CSV — один файл на таблицю (один CSV або ZIP, якщо таблиць кілька).
- Чи читаються всі сторінки?
- Так. pdftotext ділить сторінки за form feed. На кожній шукаються табличні блоки. Параметра діапазону сторінок немає.
- Чому мої числа зберігаються як текст?
- Значення записуються точно як витягнуті, тож провідні нулі й форматування зберігаються. Перетворіть колонку на числову в таблиці, якщо хочете нею рахувати.
- Чи відновлюються об’єднані комірки?
- Ні. Текст об’єднаної комірки потрапляє в найлівішу колонку, а решта лишаються порожніми. Багаторядкові комірки стають окремими рядками, а не одним перенесеним значенням.
- Чому для однієї таблиці кілька аркушів?
- Таблиця, що продовжується на новій сторінці, виявляється там знову й стає ще одним аркушем. Рядки заголовків часто повторюються; інструмент не об’єднує фрагменти.
Востаннє оновлено:
Виклик із коду
Кожен інструмент на сайті - звичайний REST-інтерфейс. Для анонімної роботи не потрібні обліковий запис чи ключ API. І для браузера, і для розробників, і для програмних агентів.
curl -X POST "https://pdf123.xyz/api/v1/convert/pdf/xlsx" \
-F "[email protected]" \
-o output.pdfТакож є як MCP-інструмент для клієнтів із Model Context Protocol (JSON-RPC 2.0 через POST /mcp). Повний довідник API
Використати через ШІ-агента
СкілЗ цим скілом Claude Code, Codex, Cursor та інші ШІ-агенти зможуть виконати «PDF у Excel» замість вас: /skills/pdf123-pdf-to-xlsx.md
Файли потрібні лише для цієї обробки й потім стираються самі.