Перейти к основному содержимому
PPDF123

Поиск и удаление пустых страниц в PDF

«Удалить пустые страницы» делит страницы PDF на пустые и непустые и возвращает их отдельными PDF в ZIP. Страница считается пустой, если в ней нет извлекаемого текста и встроенных изображений.

Перетащите файлы сюда или нажмите, чтобы выбрать

Форматы: PDF · до 500.0 MB на файл · до 20 файлов за раз

Файл можно также вставить через Ctrl/Cmd+V или из меню буфера обмена.

Удаление пустых страниц классифицирует каждую страницу как пустую или непустую и возвращает ZIP с подмножествами qpdf. Страница считается пустой, если в ней нет извлекаемого текста и встроенных изображений, поэтому страница с одними векторными линиями считается пустой. Поле `threshold` не влияет на страницы, содержащие любой текст, а `whitePercent` читается и отбрасывается.

Если есть оба класса: `{base}_blank.pdf` и `{base}_nonblank.pdf`. Все пустые: `{base}_allBlankPages.pdf`. Все непустые: `nonblank.pdf`.

Это не визуальный детектор белых страниц и не OCR. Сканированная форма как одно изображение из-за `page_has_images` считается непустой. Страница только с векторными линиями без текста может выглядеть напечатанной и всё равно попасть в пустые.

Файлы, защищённые паролем, снимаются с защиты прямо на этой странице, как только вы введёте пароль; при работе через API сначала запустите «Снять пароль».

Загрузки временные. Библиотеку ваших PDF мы не храним.

Функции

  • Эвристика текст+изображения; ZIP с пустыми и/или непустыми подмножествами
  • `whitePercent` игнорируется; `threshold` не влияет на страницы с текстом
  • Чисто графические сканы считаются непустыми
  • Анонимный API: /api/v1/misc/remove-blanks

Когда применять

  • Вытащить текстовые разделители без слов из электронного экспорта
  • Оставить страницы-сканы вместе, даже если они выглядят бледными
  • Смотреть обе части ZIP до того, как что-то выбрасывать

Как удалить пустые страницы из PDF?

  1. Загрузите PDF.
  2. Оставьте threshold и whitePercent как есть: ни то, ни другое не меняет, какие страницы с текстом или изображениями сохраняются.
  3. Нажмите «Обработать» и скачайте `{name}_removeBlanks.zip`.
  4. Если есть обе части, откройте их и убедитесь, что страницы с картинками в непустых.

Ограничения и особые случаи

  • Это не визуальное определение пустоты
  • Это не OCR
  • whitePercent бесполезен
  • Лимит загрузки на сайте: 500 МБ на файл, файлы крупнее примерно 95 МБ отправляются частями. Тело одного прямого запроса к API ограничено 100 МБ.

Примеры

  • Несколько пустых текстовых страниц плюс один скан: файл пустых и одностраничный непустой
  • Скан целиком из изображений часто даёт в ZIP только nonblank.pdf

Конфиденциальность этого инструмента

Файлы загружаются по HTTPS, обрабатываются в памяти или в короткоживущем временном каталоге на наших серверах и удаляются, когда результат готов. Копии для последующего просмотра, обучения моделей или рекламных профилей мы не храним. Сроки хранения и сведения о cookie AdSense указаны в Политике конфиденциальности.

Частые вопросы

Почему почти белая страница скана осталась?
В ней есть image XObject. Классификатор любую страницу с изображением считает непустой.
Помогает ли whitePercent 99.9?
Нет. Код привязывает поле и игнорирует его.
На выходе один PDF без пустых?
Нет. ZIP, в котором могут быть файлы пустых и непустых.
Можно сначала OCR, потом удалить пустые?
OCR возвращает Markdown, а не PDF, который сюда подать.

Последнее обновление:

Вызов из кода

Каждый инструмент на сайте: обычный REST. Анонимно не нужны ни аккаунт, ни ключ API. И для браузера, и для разработчиков, и для ИИ-агентов.

curl -X POST "https://pdf123.xyz/api/v1/misc/remove-blanks" \
  -F "[email protected]" \
  -F "threshold=10" \
  -F "whitePercent=99.9" \
  -o output.pdf

Есть и как MCP-инструмент для клиентов на Model Context Protocol (JSON-RPC 2.0, POST /mcp). Полное описание API

Использовать через ИИ-агента

Скилл

С этим скиллом Claude Code, Codex, Cursor и другие ИИ-агенты смогут выполнить «Удалить пустые страницы» за вас: /skills/pdf123-remove-blanks.md

Все скиллы для агентов

Файлы нужны только для этой обработки и потом удаляются.