Поиск и удаление пустых страниц в PDF
«Удалить пустые страницы» делит страницы PDF на пустые и непустые и возвращает их отдельными PDF в ZIP. Страница считается пустой, если в ней нет извлекаемого текста и встроенных изображений.
Перетащите файлы сюда или нажмите, чтобы выбрать
Форматы: PDF · до 500.0 MB на файл · до 20 файлов за раз
Файл можно также вставить через Ctrl/Cmd+V или из меню буфера обмена.
Удаление пустых страниц классифицирует каждую страницу как пустую или непустую и возвращает ZIP с подмножествами qpdf. Страница считается пустой, если в ней нет извлекаемого текста и встроенных изображений, поэтому страница с одними векторными линиями считается пустой. Поле `threshold` не влияет на страницы, содержащие любой текст, а `whitePercent` читается и отбрасывается.
Если есть оба класса: `{base}_blank.pdf` и `{base}_nonblank.pdf`. Все пустые: `{base}_allBlankPages.pdf`. Все непустые: `nonblank.pdf`.
Это не визуальный детектор белых страниц и не OCR. Сканированная форма как одно изображение из-за `page_has_images` считается непустой. Страница только с векторными линиями без текста может выглядеть напечатанной и всё равно попасть в пустые.
Файлы, защищённые паролем, снимаются с защиты прямо на этой странице, как только вы введёте пароль; при работе через API сначала запустите «Снять пароль».
Загрузки временные. Библиотеку ваших PDF мы не храним.
Функции
- Эвристика текст+изображения; ZIP с пустыми и/или непустыми подмножествами
- `whitePercent` игнорируется; `threshold` не влияет на страницы с текстом
- Чисто графические сканы считаются непустыми
- Анонимный API: /api/v1/misc/remove-blanks
Когда применять
- Вытащить текстовые разделители без слов из электронного экспорта
- Оставить страницы-сканы вместе, даже если они выглядят бледными
- Смотреть обе части ZIP до того, как что-то выбрасывать
Как удалить пустые страницы из PDF?
- Загрузите PDF.
- Оставьте threshold и whitePercent как есть: ни то, ни другое не меняет, какие страницы с текстом или изображениями сохраняются.
- Нажмите «Обработать» и скачайте `{name}_removeBlanks.zip`.
- Если есть обе части, откройте их и убедитесь, что страницы с картинками в непустых.
Ограничения и особые случаи
- Это не визуальное определение пустоты
- Это не OCR
- whitePercent бесполезен
- Лимит загрузки на сайте: 500 МБ на файл, файлы крупнее примерно 95 МБ отправляются частями. Тело одного прямого запроса к API ограничено 100 МБ.
Примеры
- Несколько пустых текстовых страниц плюс один скан: файл пустых и одностраничный непустой
- Скан целиком из изображений часто даёт в ZIP только nonblank.pdf
Конфиденциальность этого инструмента
Файлы загружаются по HTTPS, обрабатываются в памяти или в короткоживущем временном каталоге на наших серверах и удаляются, когда результат готов. Копии для последующего просмотра, обучения моделей или рекламных профилей мы не храним. Сроки хранения и сведения о cookie AdSense указаны в Политике конфиденциальности.
Частые вопросы
- Почему почти белая страница скана осталась?
- В ней есть image XObject. Классификатор любую страницу с изображением считает непустой.
- Помогает ли whitePercent 99.9?
- Нет. Код привязывает поле и игнорирует его.
- На выходе один PDF без пустых?
- Нет. ZIP, в котором могут быть файлы пустых и непустых.
- Можно сначала OCR, потом удалить пустые?
- OCR возвращает Markdown, а не PDF, который сюда подать.
Последнее обновление:
Вызов из кода
Каждый инструмент на сайте: обычный REST. Анонимно не нужны ни аккаунт, ни ключ API. И для браузера, и для разработчиков, и для ИИ-агентов.
curl -X POST "https://pdf123.xyz/api/v1/misc/remove-blanks" \
-F "[email protected]" \
-F "threshold=10" \
-F "whitePercent=99.9" \
-o output.pdfЕсть и как MCP-инструмент для клиентов на Model Context Protocol (JSON-RPC 2.0, POST /mcp). Полное описание API
Использовать через ИИ-агента
СкиллС этим скиллом Claude Code, Codex, Cursor и другие ИИ-агенты смогут выполнить «Удалить пустые страницы» за вас: /skills/pdf123-remove-blanks.md
Файлы нужны только для этой обработки и потом удаляются.