Przejdź do głównej treści
PPDF123

Konwersja PDF na HTML

PDF na HTML konwertuje PDF przez pdftohtml z Poppler i dostarcza ZIP ze stronami HTML i ich obrazami. To zrzut układu, a nie czysty kod stron WWW, i nie robi OCR.

Przeciągnij pliki tutaj albo kliknij, żeby wybrać

Obsługiwane: PDF · do 500.0 MB na plik · maks. 20 plików naraz

Możesz też wkleić plik przez Ctrl/Cmd+V lub z menu schowka.

Konwersja PDF na HTML uruchamia Poppler `pdftohtml -c` i pakuje do ZIP to, co narzędzie zapisze w katalogu wyjściowym. Nazwa pobrania to `{base}ToHtml.zip`, nie pojedynczy `.html`. Cel to eksport HTML i obrazów Popplera, nie CSS na poziomie przeglądarki.

Na tej stronie nie ma pól formularza. Konwertowana jest każda strona. Jeśli `pdftohtml` nic nie zapisze, API zwraca błąd wewnętrzny, nie pusty ZIP.

To nie OCR. Czyste skany obrazowe stają się obrazami w paczce HTML, nie zaznaczalnym tekstem. Pliki chronione hasłem są odblokowywane za Ciebie na tej stronie, gdy tylko wpiszesz hasło; wywołujący API najpierw uruchamiają Usuń hasło.

Jeśli potrzebujesz samego tekstu — PDF na RTF (tekst). Artykuł pod CMS — PDF na Markdown.

Przesłania są tymczasowe. Nie prowadzimy biblioteki Twojego HTML.

Funkcje

  • Poppler `pdftohtml -c`, ZIP z HTML i zasobami
  • Bez zakresu stron ani opcji motywu
  • Nie OCR; skany w paczce zostają obrazami
  • Anonimowe API: /api/v1/convert/pdf/html

Kiedy tego użyć

  • Dostać surowy HTML z PDF z warstwą tekstu
  • Zabrać obrazy stron wyciągnięte przez pdftohtml
  • Zobaczyć, jak Poppler rozumie plik, przed własnym łańcuchem przetwarzania

Jak zamienić PDF na HTML?

  1. Prześlij PDF. Na tej stronie nie ma opcji konwersji.
  2. Kliknij Przetwórz i pobierz `{name}ToHtml.zip`.
  3. Rozpakuj i otwórz HTML w przeglądarce.
  4. Sprawdź obrazy i tekst. Skany nie staną się prawdziwym tekstem HTML.

Ograniczenia i przypadki brzegowe

  • Wynik to ZIP, nie pojedynczy HTML
  • To nie druk Chromium ani eksport tagged-PDF do HTML
  • Pusty wynik pdftohtml to błąd, nie 204
  • Limit przesyłania na tej stronie: 500 MB na plik, wysyłane porcjami powyżej około 95 MB. Treść pojedynczego bezpośredniego żądania API jest ograniczona do 100 MB.

Przykłady

  • Prosta notatka tekstowa często rozpakowuje się do HTML plus kilku obrazów
  • Czysty skan PDF daje HTML głównie opakowujący obrazy stron

Prywatność tego narzędzia

Pliki są przesyłane przez HTTPS, przetwarzane w pamięci lub w krótkotrwałym katalogu tymczasowym na naszych serwerach i usuwane, gdy wynik jest gotowy. Nie przechowujemy kopii do późniejszego przeglądania, trenowania ani profili reklamowych. Szczegóły retencji i pliki cookie AdSense znajdują się w polityce prywatności.

Najczęstsze pytania

Dlaczego wynik to ZIP?
pdftohtml zapisuje HTML plus wyciągnięte obrazy do folderu. Serwer pakuje ten folder.
Czy HTML zgadza się z układem PDF?
Tylko na tyle, na ile pozwala tryb Poppler `-c`. Wielokolumnowe magazyny i gęsta grafika wektorowa często się rozjeżdżają.
Czy skan stanie się tekstem HTML?
Nie. Ta ścieżka nie robi OCR. Potrzebujesz tekstu — OCR do Markdown.
Czy konwersja dzieje się w przeglądarce?
Nie. Serwer wywołuje pdftohtml.

Ostatnia aktualizacja:

Wywołanie z kodu

Każde narzędzie na stronie to zwykły interfejs REST. Anonimowo nie trzeba konta ani klucza API. Działa w przeglądarce, u programistów i u agentów AI.

curl -X POST "https://pdf123.xyz/api/v1/convert/pdf/html" \
  -F "[email protected]" \
  -o output.pdf

Dostępne też jako narzędzie MCP dla klientów mówiących Model Context Protocol (JSON-RPC 2.0, POST /mcp). Pełna dokumentacja API

Użyj go z agentem AI

Skill

Z tym skillem Claude Code, Codex, Cursor i inne agenty AI mogą wykonać za Ciebie „PDF na HTML”: /skills/pdf123-pdf-to-html.md

Wszystkie skille dla agentów

Pliki służą tylko do tego zadania i są potem automatycznie usuwane.