Рендер первой страницы PDF в PNG
«Извлечь сканы» рендерит только первую страницу PDF в PNG 150 dpi через Ghostscript. Он не находит и не выравнивает отсканированные фотографии, а следующие страницы в результат не входят.
Перетащите файлы сюда или нажмите, чтобы выбрать
Форматы: PDF · до 500.0 MB на файл · до 20 файлов за раз
Файл можно также вставить через Ctrl/Cmd+V или из меню буфера обмена.
Извлечение сканов рендерит только страницу 1 через Ghostscript `png16m` при 150 dpi (`-dFirstPage=1 -dLastPage=1`) и возвращает этот PNG. Поля угла, допуска, минимальной площади, контура и рамки игнорируются. Нет коррекции наклона OpenCV и нет разбиения на много страниц.
Скачивание — `{base}.png`. Последующие страницы в файл не входят. Это не OCR.
Если Ghostscript не открывает файл: файлы, защищённые паролем, снимаются с защиты прямо на этой странице, как только вы введёте пароль; при работе через API сначала запустите «Снять пароль».
Каждую страницу в картинку даёт PDF в изображения. Встроенные XObject — Извлечь изображения.
Загрузка временная. Библиотеку сканов мы не храним.
Функции
- PNG первой страницы через Ghostscript, 150 dpi
- Все геометрические поля бесполезны
- Не OCR, не многостраничность, не правка наклона
- Анонимный API: /api/v1/misc/extract-image-scans
Когда применять
- Снять превью страницы 1 при 150 dpi
- Подать одиночный скан-PNG в конвейер, который ждёт одну картинку
- Не крутить бесполезные поля контура
Как превратить первую страницу PDF в PNG?
- Загрузите PDF, у которого нужный скан — на странице 1.
- Поля «как у OpenCV» можно не трогать. Они не сработают.
- Нажмите «Обработать» и скачайте PNG.
- Страницу 2 этот инструмент не отдаст.
Ограничения и особые случаи
- Только страница 1
- Фиксированные 150 dpi png16m
- Элементы правки наклона «мёртвые»
- Лимит загрузки на сайте: 500 МБ на файл, файлы крупнее примерно 95 МБ отправляются частями. Тело одного прямого запроса к API ограничено 100 МБ.
Примеры
- 10-страничный скан всё равно даёт один PNG страницы 1
- Изменение minArea этот PNG не обрежет
Конфиденциальность этого инструмента
Файлы загружаются по HTTPS, обрабатываются в памяти или в короткоживущем временном каталоге на наших серверах и удаляются, когда результат готов. Копии для последующего просмотра, обучения моделей или рекламных профилей мы не храним. Сроки хранения и сведения о cookie AdSense указаны в Политике конфиденциальности.
Частые вопросы
- Почему в PNG только страница 1?
- Вызов gs с FirstPage=1 и LastPage=1. Вся операция именно такая.
- angleThreshold выровняет скан?
- Нет. Параметр бесполезен.
- Это то же, что PDF в изображения?
- Нет. PDF в изображения может рендерить много страниц. Здесь всегда страница 1, PNG 150 dpi.
- Будет ли выделяемый текст?
- Нет. Результат — растр. OCR в Markdown возвращает Markdown.
Последнее обновление:
Вызов из кода
Каждый инструмент на сайте: обычный REST. Анонимно не нужны ни аккаунт, ни ключ API. И для браузера, и для разработчиков, и для ИИ-агентов.
curl -X POST "https://pdf123.xyz/api/v1/misc/extract-image-scans" \
-F "[email protected]" \
-o output.pdfЕсть и как MCP-инструмент для клиентов на Model Context Protocol (JSON-RPC 2.0, POST /mcp). Полное описание API
Использовать через ИИ-агента
СкиллС этим скиллом Claude Code, Codex, Cursor и другие ИИ-агенты смогут выполнить «Извлечь сканы» за вас: /skills/pdf123-extract-image-scans.md
Файлы нужны только для этой обработки и потом удаляются.