Перейти к основному содержимому
PPDF123

Преобразование таблиц PDF в Excel

«PDF в Excel» находит выровненные строки таблиц в тексте PDF и записывает каждую таблицу на отдельный лист книги .xlsx. Нужен текстовый слой; для сплошного текста и отсканированных страниц результата не будет.

Перетащите файлы сюда или нажмите, чтобы выбрать

Форматы: PDF · до 500.0 MB на файл · до 20 файлов за раз

Файл можно также вставить через Ctrl/Cmd+V или из меню буфера обмена.

PDF в Excel запускает `pdftotext -layout`, ищет строки с двумя и более пробелами подряд и пишет эти ряды в книгу `.xlsx`. Каждая найденная таблица становится листом `Page N` или `Page N Table M`. Подходит для цифровых PDF, где колонки уже выровнены в извлечённом тексте.

Таблице нужны хотя бы две табличные строки подряд. Проза, одна строка заголовка или скан без текстового слоя дают `no_content`: книги нет. Пустой результат намеренный, не тихий сбой.

Параметры запроса игнорируются. Поля диапазона страниц на этой странице нет. Колонки режутся по сериям из двух и более пробелов; один пробел внутри ячейки остаётся в ячейке.

Это не OCR. У чисто графического скана `pdftotext` нечего читать. OCR на этом сайте возвращает Markdown; его нельзя снова отправить в PDF в Excel. Если знаки есть только в пикселях, таблицы здесь не будет.

PDF в CSV использует ту же эвристику вёрстки. Одна таблица становится одним CSV; несколько — ZIP из CSV. Excel держит эти таблицы листами одной книги. Ни то ни другое не восстанавливает из PDF объединённые ячейки, цветные шапки или скрытые листы.

Откройте скачивание в Excel или LibreOffice Calc и проверьте разрезы колонок на нескольких строках. Плотные таблицы без зазора в два пробела часто падают в одну колонку. Файлы, защищённые паролем, снимаются с защиты прямо на этой странице, как только вы введёте пароль; при работе через API сначала запустите «Снять пароль».

Загрузки временные. Библиотеку ваших книг мы не храним.

Функции

  • `pdftotext -layout` плюс эвристика колонок по двум пробелам
  • Один лист на найденную таблицу; пустое обнаружение не отдаёт файл
  • Не OCR; Markdown с OCR сюда отправить нельзя
  • Анонимный API: /api/v1/convert/pdf/xlsx

Когда применять

  • Открыть извлечённые таблицы сразу в Excel или LibreOffice Calc
  • Перенести таблицу цифровой накладной в книгу
  • Держать таблицы с нескольких страниц листами, а не одним CSV

Как преобразовать таблицу PDF в Excel?

  1. Загрузите PDF с выделяемым текстом и колонками в виде таблицы.
  2. Нажмите «Обработать». Параметров страниц или OCR у этого инструмента нет.
  3. Если таблицы найдены — скачайте `.xlsx`. Если нет — успех приходит пустым; возьмите источник с текстовым слоем.
  4. Откройте книгу и проверьте разрезы. Чисто прозаические PDF листов не дадут.

Ограничения и особые случаи

  • Нужен выделяемый текст и зазор колонок в два пробела
  • Нет OCR и нет выбора диапазона страниц
  • Не восстанавливает объединённые ячейки и стили
  • Лимит загрузки на сайте: 500 МБ на файл, файлы крупнее примерно 95 МБ отправляются частями. Тело одного прямого запроса к API ограничено 100 МБ.

Примеры

  • Текстовый PDF с трёхколоночным прайсом часто становится листом этих колонок
  • Отсканированная банковская выписка без текстового слоя книгу не вернёт

Конфиденциальность этого инструмента

Файлы загружаются по HTTPS, обрабатываются в памяти или в короткоживущем временном каталоге на наших серверах и удаляются, когда результат готов. Копии для последующего просмотра, обучения моделей или рекламных профилей мы не храним. Сроки хранения и сведения о cookie AdSense указаны в Политике конфиденциальности.

Частые вопросы

Почему нет электронной таблицы?
Не найден блок из двух и более табличных строк подряд. Сканы, проза и таблицы без зазора в два пробела эту эвристику не проходят.
Можно сначала OCR, потом Excel?
Нет. OCR возвращает Markdown. Этот инструмент читает PDF только через pdftotext.
Чем это отличается от PDF в CSV?
Обнаружение одинаковое. Excel пишет каждую таблицу на свой лист одной книги. CSV — один файл на таблицу (один CSV или ZIP, если таблиц несколько).
Читаются ли все страницы?
Да. pdftotext делит страницы по form feed. На каждой ищутся табличные блоки. Параметра диапазона страниц нет.

Последнее обновление:

Вызов из кода

Каждый инструмент на сайте: обычный REST. Анонимно не нужны ни аккаунт, ни ключ API. И для браузера, и для разработчиков, и для ИИ-агентов.

curl -X POST "https://pdf123.xyz/api/v1/convert/pdf/xlsx" \
  -F "[email protected]" \
  -o output.pdf

Есть и как MCP-инструмент для клиентов на Model Context Protocol (JSON-RPC 2.0, POST /mcp). Полное описание API

Использовать через ИИ-агента

Скилл

С этим скиллом Claude Code, Codex, Cursor и другие ИИ-агенты смогут выполнить «PDF в Excel» за вас: /skills/pdf123-pdf-to-xlsx.md

Все скиллы для агентов

Файлы нужны только для этой обработки и потом удаляются.