Konwersja PDF na HTML
PDF na HTML konwertuje PDF przez pdftohtml z Poppler i dostarcza ZIP ze stronami HTML i ich obrazami. To zrzut układu, a nie czysty kod stron WWW, i nie robi OCR.
Przeciągnij pliki tutaj albo kliknij, żeby wybrać
Obsługiwane: PDF · do 500.0 MB na plik · maks. 20 plików naraz
Możesz też wkleić plik przez Ctrl/Cmd+V lub z menu schowka.
Konwersja PDF na HTML uruchamia Poppler `pdftohtml -c` i pakuje do ZIP to, co narzędzie zapisze w katalogu wyjściowym. Nazwa pobrania to `{base}ToHtml.zip`, nie pojedynczy `.html`. Cel to eksport HTML i obrazów Popplera, nie CSS na poziomie przeglądarki.
Na tej stronie nie ma pól formularza. Konwertowana jest każda strona. Jeśli `pdftohtml` nic nie zapisze, API zwraca błąd wewnętrzny, nie pusty ZIP.
To nie OCR. Czyste skany obrazowe stają się obrazami w paczce HTML, nie zaznaczalnym tekstem. Pliki chronione hasłem są odblokowywane za Ciebie na tej stronie, gdy tylko wpiszesz hasło; wywołujący API najpierw uruchamiają Usuń hasło.
Jeśli potrzebujesz samego tekstu — PDF na RTF (tekst). Artykuł pod CMS — PDF na Markdown.
Przesłania są tymczasowe. Nie prowadzimy biblioteki Twojego HTML.
Funkcje
- Poppler `pdftohtml -c`, ZIP z HTML i zasobami
- Bez zakresu stron ani opcji motywu
- Nie OCR; skany w paczce zostają obrazami
- Anonimowe API: /api/v1/convert/pdf/html
Kiedy tego użyć
- Dostać surowy HTML z PDF z warstwą tekstu
- Zabrać obrazy stron wyciągnięte przez pdftohtml
- Zobaczyć, jak Poppler rozumie plik, przed własnym łańcuchem przetwarzania
Jak zamienić PDF na HTML?
- Prześlij PDF. Na tej stronie nie ma opcji konwersji.
- Kliknij Przetwórz i pobierz `{name}ToHtml.zip`.
- Rozpakuj i otwórz HTML w przeglądarce.
- Sprawdź obrazy i tekst. Skany nie staną się prawdziwym tekstem HTML.
Ograniczenia i przypadki brzegowe
- Wynik to ZIP, nie pojedynczy HTML
- To nie druk Chromium ani eksport tagged-PDF do HTML
- Pusty wynik pdftohtml to błąd, nie 204
- Limit przesyłania na tej stronie: 500 MB na plik, wysyłane porcjami powyżej około 95 MB. Treść pojedynczego bezpośredniego żądania API jest ograniczona do 100 MB.
Przykłady
- Prosta notatka tekstowa często rozpakowuje się do HTML plus kilku obrazów
- Czysty skan PDF daje HTML głównie opakowujący obrazy stron
Prywatność tego narzędzia
Pliki są przesyłane przez HTTPS, przetwarzane w pamięci lub w krótkotrwałym katalogu tymczasowym na naszych serwerach i usuwane, gdy wynik jest gotowy. Nie przechowujemy kopii do późniejszego przeglądania, trenowania ani profili reklamowych. Szczegóły retencji i pliki cookie AdSense znajdują się w polityce prywatności.
Najczęstsze pytania
- Dlaczego wynik to ZIP?
- pdftohtml zapisuje HTML plus wyciągnięte obrazy do folderu. Serwer pakuje ten folder.
- Czy HTML zgadza się z układem PDF?
- Tylko na tyle, na ile pozwala tryb Poppler `-c`. Wielokolumnowe magazyny i gęsta grafika wektorowa często się rozjeżdżają.
- Czy skan stanie się tekstem HTML?
- Nie. Ta ścieżka nie robi OCR. Potrzebujesz tekstu — OCR do Markdown.
- Czy konwersja dzieje się w przeglądarce?
- Nie. Serwer wywołuje pdftohtml.
Ostatnia aktualizacja:
Wywołanie z kodu
Każde narzędzie na stronie to zwykły interfejs REST. Anonimowo nie trzeba konta ani klucza API. Działa w przeglądarce, u programistów i u agentów AI.
curl -X POST "https://pdf123.xyz/api/v1/convert/pdf/html" \
-F "[email protected]" \
-o output.pdfDostępne też jako narzędzie MCP dla klientów mówiących Model Context Protocol (JSON-RPC 2.0, POST /mcp). Pełna dokumentacja API
Użyj go z agentem AI
SkillZ tym skillem Claude Code, Codex, Cursor i inne agenty AI mogą wykonać za Ciebie „PDF na HTML”: /skills/pdf123-pdf-to-html.md
Pliki służą tylko do tego zadania i są potem automatycznie usuwane.