Преобразование таблиц PDF в Excel
«PDF в Excel» находит выровненные строки таблиц в тексте PDF и записывает каждую таблицу на отдельный лист книги .xlsx. Нужен текстовый слой; для сплошного текста и отсканированных страниц результата не будет.
Перетащите файлы сюда или нажмите, чтобы выбрать
Форматы: PDF · до 500.0 MB на файл · до 20 файлов за раз
Файл можно также вставить через Ctrl/Cmd+V или из меню буфера обмена.
PDF в Excel запускает `pdftotext -layout`, ищет строки с двумя и более пробелами подряд и пишет эти ряды в книгу `.xlsx`. Каждая найденная таблица становится листом `Page N` или `Page N Table M`. Подходит для цифровых PDF, где колонки уже выровнены в извлечённом тексте.
Таблице нужны хотя бы две табличные строки подряд. Проза, одна строка заголовка или скан без текстового слоя дают `no_content`: книги нет. Пустой результат намеренный, не тихий сбой.
Параметры запроса игнорируются. Поля диапазона страниц на этой странице нет. Колонки режутся по сериям из двух и более пробелов; один пробел внутри ячейки остаётся в ячейке.
Это не OCR. У чисто графического скана `pdftotext` нечего читать. OCR на этом сайте возвращает Markdown; его нельзя снова отправить в PDF в Excel. Если знаки есть только в пикселях, таблицы здесь не будет.
PDF в CSV использует ту же эвристику вёрстки. Одна таблица становится одним CSV; несколько — ZIP из CSV. Excel держит эти таблицы листами одной книги. Ни то ни другое не восстанавливает из PDF объединённые ячейки, цветные шапки или скрытые листы.
Откройте скачивание в Excel или LibreOffice Calc и проверьте разрезы колонок на нескольких строках. Плотные таблицы без зазора в два пробела часто падают в одну колонку. Файлы, защищённые паролем, снимаются с защиты прямо на этой странице, как только вы введёте пароль; при работе через API сначала запустите «Снять пароль».
Загрузки временные. Библиотеку ваших книг мы не храним.
Функции
- `pdftotext -layout` плюс эвристика колонок по двум пробелам
- Один лист на найденную таблицу; пустое обнаружение не отдаёт файл
- Не OCR; Markdown с OCR сюда отправить нельзя
- Анонимный API: /api/v1/convert/pdf/xlsx
Когда применять
- Открыть извлечённые таблицы сразу в Excel или LibreOffice Calc
- Перенести таблицу цифровой накладной в книгу
- Держать таблицы с нескольких страниц листами, а не одним CSV
Как преобразовать таблицу PDF в Excel?
- Загрузите PDF с выделяемым текстом и колонками в виде таблицы.
- Нажмите «Обработать». Параметров страниц или OCR у этого инструмента нет.
- Если таблицы найдены — скачайте `.xlsx`. Если нет — успех приходит пустым; возьмите источник с текстовым слоем.
- Откройте книгу и проверьте разрезы. Чисто прозаические PDF листов не дадут.
Ограничения и особые случаи
- Нужен выделяемый текст и зазор колонок в два пробела
- Нет OCR и нет выбора диапазона страниц
- Не восстанавливает объединённые ячейки и стили
- Лимит загрузки на сайте: 500 МБ на файл, файлы крупнее примерно 95 МБ отправляются частями. Тело одного прямого запроса к API ограничено 100 МБ.
Примеры
- Текстовый PDF с трёхколоночным прайсом часто становится листом этих колонок
- Отсканированная банковская выписка без текстового слоя книгу не вернёт
Конфиденциальность этого инструмента
Файлы загружаются по HTTPS, обрабатываются в памяти или в короткоживущем временном каталоге на наших серверах и удаляются, когда результат готов. Копии для последующего просмотра, обучения моделей или рекламных профилей мы не храним. Сроки хранения и сведения о cookie AdSense указаны в Политике конфиденциальности.
Частые вопросы
- Почему нет электронной таблицы?
- Не найден блок из двух и более табличных строк подряд. Сканы, проза и таблицы без зазора в два пробела эту эвристику не проходят.
- Можно сначала OCR, потом Excel?
- Нет. OCR возвращает Markdown. Этот инструмент читает PDF только через pdftotext.
- Чем это отличается от PDF в CSV?
- Обнаружение одинаковое. Excel пишет каждую таблицу на свой лист одной книги. CSV — один файл на таблицу (один CSV или ZIP, если таблиц несколько).
- Читаются ли все страницы?
- Да. pdftotext делит страницы по form feed. На каждой ищутся табличные блоки. Параметра диапазона страниц нет.
Последнее обновление:
Вызов из кода
Каждый инструмент на сайте: обычный REST. Анонимно не нужны ни аккаунт, ни ключ API. И для браузера, и для разработчиков, и для ИИ-агентов.
curl -X POST "https://pdf123.xyz/api/v1/convert/pdf/xlsx" \
-F "[email protected]" \
-o output.pdfЕсть и как MCP-инструмент для клиентов на Model Context Protocol (JSON-RPC 2.0, POST /mcp). Полное описание API
Использовать через ИИ-агента
СкиллС этим скиллом Claude Code, Codex, Cursor и другие ИИ-агенты смогут выполнить «PDF в Excel» за вас: /skills/pdf123-pdf-to-xlsx.md
Файлы нужны только для этой обработки и потом удаляются.