Превърнете PDF в HTML
PDF към HTML превръща PDF с pdftohtml на Poppler и връща ZIP с HTML страниците и техните изображения. Това е изхвърляне на макета, а не чист уеб код, и не прави OCR.
Плъзнете файлове тук или кликнете, за да изберете
Приема PDF · до 500.0 MB на файл · до 20 файла наведнъж
Можете също да поставите файл с Ctrl/Cmd+V или от менюто на клипборда.
PDF към HTML пуска Poppler `pdftohtml -c` и пакетира съдържанието, което инструментът записва в изходната директория, в ZIP. Името на изтеглянето е `{base}ToHtml.zip`, не единичен `.html`. Целта не е браузърски CSS, а HTML и картинки от Poppler.
На страницата няма полета на формата. Всяка страница се конвертира. Ако `pdftohtml` не запише нищо, интерфейсът връща вътрешна грешка, не празен ZIP.
Това не е OCR. Чисто изображенните сканове стават картинки в HTML пакета, не избираем текст. Файловете, защитени с парола, се отключват вместо вас на тази страница, щом въведете паролата; при API първо пуснете «Премахване на парола».
За само текст ползвайте «PDF към RTF (текст)». За статия, подходяща за CMS — «PDF към Markdown».
Качванията са временни. Не пазим HTML библиотека.
Възможности
- Poppler `pdftohtml -c`, ZIP с HTML и ресурси
- Без диапазон страници или тема
- Не е OCR; скановете в пакета остават картинки
- Анонимен API: /api/v1/convert/pdf/html
Кога да го използвате
- Груб HTML от PDF с текстов слой
- Изваждане на странични картинки от pdftohtml
- Преглед как Poppler разбира файла преди собствен конвейер
Как да превърна PDF в HTML?
- Качете PDF. На страницата няма опции за конвертиране.
- Стартирайте обработката и изтеглете `{name}ToHtml.zip`.
- Разархивирайте и отворете HTML в браузър.
- Проверете картинки и текст. Скановете не стават истински HTML текст.
Ограничения и крайни случаи
- Изходът е ZIP, не единичен HTML
- Не е Chromium печат и не е tagged-PDF HTML износ
- Празен изход от pdftohtml е грешка, не 204
- Ограничение за качване на този сайт: 500 MB на файл; над около 95 MB файлът се изпраща на части. Тялото на една пряка API заявка е ограничено до 100 MB.
Примери
- Проста текстова бележка често се разархивира като HTML плюс няколко картинки
- Чисто сканиран PDF дава HTML, който предимно обвива страничните картинки
Поверителност при този инструмент
Файловете се качват по HTTPS, обработват се в паметта или в краткоживуща временна директория на нашите сървъри и се изтриват, щом резултатът е готов. Не задържаме копия за по-късен преглед, обучение на модели или рекламни профили. Сроковете за съхранение и обясненията за бисквитките на AdSense са в Политиката за поверителност.
Често задавани въпроси
- Защо резултатът е ZIP?
- pdftohtml пише HTML плюс извлечени картинки в папка. Сървърът пакетира тази папка.
- HTML съвпада ли с макета на PDF?
- Доколкото позволява режимът `-c` на Poppler. Многоколонни списания и тежки вектори често се разминават.
- Може ли скан да стане HTML текст?
- Не. Този път не прави OCR. За текст ползвайте «OCR към Markdown».
- Конвертира ли се в браузъра?
- Не. Сървърът вика pdftohtml.
Последна актуализация:
Извикване от код
Всеки инструмент е обикновен REST интерфейс. За анонимна употреба не трябват профил или API ключ. Работи еднакво в браузър, за разработчици и за AI агенти.
curl -X POST "https://pdf123.xyz/api/v1/convert/pdf/html" \
-F "[email protected]" \
-o output.pdfНаличен е и като MCP инструмент за клиенти с Model Context Protocol (JSON-RPC 2.0 през POST /mcp). Пълна API документация
Използвайте го чрез AI агент
СкилС този скил Claude Code, Codex, Cursor и други AI агенти могат да изпълнят „PDF към HTML“ вместо вас: /skills/pdf123-pdf-to-html.md
Файловете служат само за тази обработка и после се изтриват автоматично.