Към основното съдържание
PPDF123

Превърнете PDF в HTML

PDF към HTML превръща PDF с pdftohtml на Poppler и връща ZIP с HTML страниците и техните изображения. Това е изхвърляне на макета, а не чист уеб код, и не прави OCR.

Плъзнете файлове тук или кликнете, за да изберете

Приема PDF · до 500.0 MB на файл · до 20 файла наведнъж

Можете също да поставите файл с Ctrl/Cmd+V или от менюто на клипборда.

PDF към HTML пуска Poppler `pdftohtml -c` и пакетира съдържанието, което инструментът записва в изходната директория, в ZIP. Името на изтеглянето е `{base}ToHtml.zip`, не единичен `.html`. Целта не е браузърски CSS, а HTML и картинки от Poppler.

На страницата няма полета на формата. Всяка страница се конвертира. Ако `pdftohtml` не запише нищо, интерфейсът връща вътрешна грешка, не празен ZIP.

Това не е OCR. Чисто изображенните сканове стават картинки в HTML пакета, не избираем текст. Файловете, защитени с парола, се отключват вместо вас на тази страница, щом въведете паролата; при API първо пуснете «Премахване на парола».

За само текст ползвайте «PDF към RTF (текст)». За статия, подходяща за CMS — «PDF към Markdown».

Качванията са временни. Не пазим HTML библиотека.

Възможности

  • Poppler `pdftohtml -c`, ZIP с HTML и ресурси
  • Без диапазон страници или тема
  • Не е OCR; скановете в пакета остават картинки
  • Анонимен API: /api/v1/convert/pdf/html

Кога да го използвате

  • Груб HTML от PDF с текстов слой
  • Изваждане на странични картинки от pdftohtml
  • Преглед как Poppler разбира файла преди собствен конвейер

Как да превърна PDF в HTML?

  1. Качете PDF. На страницата няма опции за конвертиране.
  2. Стартирайте обработката и изтеглете `{name}ToHtml.zip`.
  3. Разархивирайте и отворете HTML в браузър.
  4. Проверете картинки и текст. Скановете не стават истински HTML текст.

Ограничения и крайни случаи

  • Изходът е ZIP, не единичен HTML
  • Не е Chromium печат и не е tagged-PDF HTML износ
  • Празен изход от pdftohtml е грешка, не 204
  • Ограничение за качване на този сайт: 500 MB на файл; над около 95 MB файлът се изпраща на части. Тялото на една пряка API заявка е ограничено до 100 MB.

Примери

  • Проста текстова бележка често се разархивира като HTML плюс няколко картинки
  • Чисто сканиран PDF дава HTML, който предимно обвива страничните картинки

Поверителност при този инструмент

Файловете се качват по HTTPS, обработват се в паметта или в краткоживуща временна директория на нашите сървъри и се изтриват, щом резултатът е готов. Не задържаме копия за по-късен преглед, обучение на модели или рекламни профили. Сроковете за съхранение и обясненията за бисквитките на AdSense са в Политиката за поверителност.

Често задавани въпроси

Защо резултатът е ZIP?
pdftohtml пише HTML плюс извлечени картинки в папка. Сървърът пакетира тази папка.
HTML съвпада ли с макета на PDF?
Доколкото позволява режимът `-c` на Poppler. Многоколонни списания и тежки вектори често се разминават.
Може ли скан да стане HTML текст?
Не. Този път не прави OCR. За текст ползвайте «OCR към Markdown».
Конвертира ли се в браузъра?
Не. Сървърът вика pdftohtml.

Последна актуализация:

Извикване от код

Всеки инструмент е обикновен REST интерфейс. За анонимна употреба не трябват профил или API ключ. Работи еднакво в браузър, за разработчици и за AI агенти.

curl -X POST "https://pdf123.xyz/api/v1/convert/pdf/html" \
  -F "[email protected]" \
  -o output.pdf

Наличен е и като MCP инструмент за клиенти с Model Context Protocol (JSON-RPC 2.0 през POST /mcp). Пълна API документация

Използвайте го чрез AI агент

Скил

С този скил Claude Code, Codex, Cursor и други AI агенти могат да изпълнят „PDF към HTML“ вместо вас: /skills/pdf123-pdf-to-html.md

Всички скилове за агенти

Файловете служат само за тази обработка и после се изтриват автоматично.