Langkau ke kandungan utama
PPDF123

Tukar PDF kepada HTML

PDF ke HTML menukar PDF dengan pdftohtml Poppler dan menyerahkan ZIP yang mengandungi halaman HTML dan imejnya. Ia longgokan susun atur dan bukan markup web yang bersih, dan ia tidak melakukan OCR.

Seret dan lepaskan fail di sini, atau klik untuk pilih

Menerima PDF · sehingga 500.0 MB setiap fail · sehingga 20 fail sekali gus

Anda juga boleh menampal fail dengan Ctrl/Cmd+V atau dari menu papan keratan.

PDF ke HTML menjalankan Poppler `pdftohtml -c`, kemudian membungkus kandungan yang alat itu tulis ke direktori output sebagai ZIP. Nama muat turun ialah `{base}ToHtml.zip`, bukan satu `.html`. Sasaran bukan CSS tahap penyemak imbas, melainkan eksport HTML dan imej Poppler.

Halaman ini tiada medan borang. Setiap halaman ditukar. Jika `pdftohtml` tidak menulis apa-apa, API memulangkan ralat dalaman, bukan ZIP kosong.

Ini bukan OCR. Imbasan imej sahaja menjadi imej dalam bungkusan HTML, bukan teks boleh dipilih. Fail yang dilindungi kata laluan dibuka untuk anda pada halaman ini sebaik sahaja anda memasukkan kata laluan; pemanggil API perlu menjalankan Buang kata laluan dahulu.

Jika hanya mahu teks, guna PDF ke RTF (Teks). Jika mahu artikel sesuai CMS, guna PDF ke Markdown.

Muat naik bersifat sementara. Kami tidak menyimpan pustaka HTML anda.

Ciri

  • Poppler `pdftohtml -c`, output ZIP HTML plus sumber
  • Tiada julat halaman atau pilihan tema
  • Bukan OCR; imbasan kekal imej dalam bungkusan
  • API tanpa nama: /api/v1/convert/pdf/html

Bila menggunakan alat ini

  • Dapatkan HTML kasar daripada PDF berlapisan teks
  • Ambil imej halaman yang diekstrak pdftohtml
  • Lihat bagaimana Poppler memahami fail sebelum saluran sendiri

Bagaimana cara menukar PDF kepada HTML?

  1. Muat naik PDF. Halaman ini tiada pilihan penukaran.
  2. Klik proses, muat turun `{name}ToHtml.zip`.
  3. Nyahmampat dan buka HTML dalam penyemak imbas.
  4. Semak imej dan teks. Imbasan tidak menjadi teks HTML sebenar.

Had dan kes khas

  • Output ialah ZIP, bukan satu HTML
  • Bukan cetakan Chromium, juga bukan eksport HTML daripada PDF berlabel
  • Output pdftohtml kosong ialah ralat, bukan 204
  • Had muat naik di tapak web ini: 500 MB setiap fail, dihantar berketul-ketul melebihi kira-kira 95 MB. Satu badan permintaan API langsung dihadkan pada 100 MB.

Contoh

  • Memo teks ringkas sering dinyahmampat kepada satu HTML plus beberapa imej
  • PDF imbasan sahaja biasanya mendapat HTML yang kebanyakannya membungkus imej halaman

Privasi untuk alat ini

Fail dimuat naik melalui HTTPS, diproses dalam memori atau direktori sementara singkat di pelayan kami, kemudian dipadam apabila hasil sedia. Kami tidak menyimpan salinan untuk semakan kemudian, latihan, atau profil iklan. Lihat Dasar Privasi untuk pengekalan dan pendedahan kuki AdSense.

Soalan lazim

Mengapa hasil ialah ZIP?
pdftohtml menulis HTML plus imej yang diekstrak ke satu folder. Pelayan membungkus folder itu.
Adakah HTML sepadan dengan susun atur PDF?
Hanya setakat modus Poppler `-c`. Majalah berbilang lajur dan banyak vektor sering tidak sejajar.
Bolehkah imbasan menjadi teks HTML?
Tidak. Laluan ini tiada OCR. Untuk teks, guna OCR ke Markdown.
Adakah penukaran dalam penyemak imbas?
Tidak. Pelayan memanggil pdftohtml.

Kemas kini terakhir:

Panggil dari kod

Setiap alat di laman ini ialah panggilan REST biasa. Penggunaan tanpa nama tidak perlukan akaun atau kunci API. Untuk pelayar, pembangun dan ejen AI sama-sama.

curl -X POST "https://pdf123.xyz/api/v1/convert/pdf/html" \
  -F "[email protected]" \
  -o output.pdf

Juga tersedia sebagai alat MCP untuk klien ejen yang menggunakan Model Context Protocol (JSON-RPC 2.0 melalui POST /mcp). Rujukan API penuh

Gunakan melalui ejen AI

Skill

Dengan skill ini, Claude Code, Codex, Cursor dan ejen AI lain boleh menjalankan "PDF ke HTML" bagi pihak anda: /skills/pdf123-pdf-to-html.md

Semua skill ejen

Fail hanya digunakan untuk pemprosesan ini dan dipadam secara automatik selepas itu.