Перетворення PDF на HTML
PDF у HTML перетворює PDF через pdftohtml із Poppler і віддає ZIP зі сторінками HTML та їхніми зображеннями. Це зліпок макета, а не чиста веброзмітка, і OCR він не виконує.
Перетягніть файли сюди або натисніть, щоб вибрати
Формати: PDF · до 500.0 MB на файл · до 20 файлів за раз
Файл також можна вставити через Ctrl/Cmd+V або з меню буфера обміну.
PDF у HTML запускає Poppler `pdftohtml -c` і пакує в ZIP те, що інструмент пише в каталог виводу. Ім’я завантаження — `{base}ToHtml.zip`, не один `.html`. Мета — HTML і картинки Poppler, не браузерний CSS продакшену.
Полів форми немає. Конвертуються всі сторінки. Якщо `pdftohtml` нічого не записав, API повертає внутрішню помилку, а не порожній ZIP.
Це не OCR. Суто зображені скани стають картинками в пакеті, не виділюваним текстом. Файли, захищені паролем, на цій сторінці розблоковуються за вас, щойно ви введете пароль; виклики через API спочатку виконують «Зняти пароль».
Якщо потрібен лише текст — «PDF у RTF (текст)». Для статті під CMS — «PDF у Markdown».
Вивантаження тимчасові. Бібліотеки HTML ми не зберігаємо.
Що вміє
- Poppler `pdftohtml -c` → ZIP HTML і ресурсів
- Немає діапазону сторінок чи теми
- Не OCR; скани в пакеті лишаються зображеннями
- Анонімний API: /api/v1/convert/pdf/html
Коли брати цей інструмент
- Швидкий HTML-експорт Poppler
- Отримати картинки сторінок разом із розміткою
- Не плутати з Markdown для CMS
Як перетворити PDF на HTML?
- Вивантажте PDF.
- Натисніть «Обробити».
- Завантажте ZIP.
- Відкрийте HTML з пакета локально.
Обмеження і межі
- Не продакшен-CSS
- Не OCR
- Файли, захищені паролем, потребують пароля; виклики через API спочатку виконують «Зняти пароль»
- Обмеження завантаження на цьому сайті: 500 МБ на файл; якщо файл більший за приблизно 95 МБ, він надсилається частинами. Тіло одного прямого запиту до API — не більше 100 МБ.
Приклади
- doc.pdf → docToHtml.zip
- Скан → HTML із зображеннями сторінок
Приватність цього інструмента
Файли надсилаються через HTTPS, обробляються в оперативній пам’яті або в короткочасному тимчасовому каталозі на наших серверах і видаляються, щойно результат готовий. Копій для подальшого перегляду, навчання моделей чи рекламних профілів ми не зберігаємо. Строки зберігання та відомості про файли cookie AdSense наведені в Політиці конфіденційності.
Часті запитання
- Чому ZIP, а не один HTML?
- Poppler пише HTML плюс ресурси; відповідь пакує каталог.
- Чи це OCR?
- Ні.
- Чи є вибір сторінок?
- Ні. Усі сторінки.
- Порожній вивід?
- Якщо pdftohtml нічого не писав — внутрішня помилка, не порожній ZIP.
Востаннє оновлено:
Виклик із коду
Кожен інструмент на сайті - звичайний REST-інтерфейс. Для анонімної роботи не потрібні обліковий запис чи ключ API. І для браузера, і для розробників, і для програмних агентів.
curl -X POST "https://pdf123.xyz/api/v1/convert/pdf/html" \
-F "[email protected]" \
-o output.pdfТакож є як MCP-інструмент для клієнтів із Model Context Protocol (JSON-RPC 2.0 через POST /mcp). Повний довідник API
Використати через ШІ-агента
СкілЗ цим скілом Claude Code, Codex, Cursor та інші ШІ-агенти зможуть виконати «PDF у HTML» замість вас: /skills/pdf123-pdf-to-html.md
Файли потрібні лише для цієї обробки й потім стираються самі.