ข้ามไปยังเนื้อหาหลัก
PPDF123

แปลง PDF เป็น HTML

PDF เป็น HTML คือเครื่องมือที่แปลง PDF ด้วย pdftohtml ของ Poppler แล้วส่ง ZIP ที่มีหน้า HTML และภาพของหน้า เป็นการถ่ายทอดเลย์เอาต์ ไม่ใช่มาร์กอัปเว็บที่สะอาด และไม่ทำ OCR

ลากไฟล์มาที่นี่ หรือคลิกเพื่อเลือก

รองรับ PDF · ไม่เกิน 500.0 MB ต่อไฟล์ · สูงสุด 20 ไฟล์ต่อครั้ง

คุณวางไฟล์ด้วย Ctrl/Cmd+V หรือจากเมนูคลิปบอร์ดได้เช่นกัน

การแปลง PDF เป็น HTML รัน Poppler `pdftohtml -c` แล้วแพ็กเนื้อหาที่เครื่องมือเขียนลงไดเรกทอรีผลเป็น ZIP ชื่อดาวน์โหลดเป็น `{base}ToHtml.zip` ไม่ใช่ `.html` เดี่ยว เป้าหมายไม่ใช่ CSS ระดับเบราว์เซอร์ แต่เป็นการส่งออก HTML และภาพของ Poppler

หน้านี้ไม่มีฟิลด์ฟอร์ม แปลงทุกหน้า ถ้า `pdftohtml` ไม่เขียนอะไร อินเทอร์เฟซคืนข้อผิดพลาดภายใน ไม่ใช่ ZIP ว่าง

นี่ไม่ใช่ OCR สแกนภาพล้วนกลายเป็นภาพในแพ็ก HTML ไม่ใช่ข้อความเลือกได้ ไฟล์ที่มีรหัสผ่านจะถูกปลดล็อกให้ในหน้านี้เมื่อคุณใส่รหัสผ่าน ส่วนผู้เรียก API ให้รันถอดรหัสผ่านก่อน

ถ้าต้องการแค่ข้อความ ใช้ PDF เป็นข้อความ ถ้าต้องการบทความสำหรับ CMS ใช้ PDF เป็น Markdown

ความสามารถ

  • Poppler `pdftohtml -c` ผลเป็น ZIP ของ HTML และทรัพยากร
  • ไม่มีตัวเลือกช่วงหน้าหรือธีม
  • ไม่ใช่ OCR สแกนในแพ็กยังเป็นภาพ
  • API แบบไม่ระบุตัวตน: /api/v1/convert/pdf/html

ใช้เมื่อไหร่

  • ได้ HTML หยาบจาก PDF ที่มีชั้นข้อความ
  • นำภาพหน้าที่ pdftohtml ดึงออกไปใช้
  • ดูก่อนว่า Poppler อ่านไฟล์นี้อย่างไร ก่อนทำท่อเอง

แปลง PDF เป็น HTML ได้อย่างไร

  1. อัปโหลด PDF หน้านี้ไม่มีตัวเลือกการแปลง
  2. คลิกเริ่มประมวลผล แล้วดาวน์โหลด `{name}ToHtml.zip`
  3. แตกไฟล์แล้วเปิด HTML ในเบราว์เซอร์
  4. ตรวจภาพและข้อความ สแกนจะไม่กลายเป็นข้อความ HTML จริง

ข้อจำกัดและกรณีพิเศษ

  • ผลเป็น ZIP ไม่ใช่ HTML เดี่ยว
  • ไม่ใช่การพิมพ์ Chromium และไม่ใช่การส่งออก HTML จาก tagged-PDF
  • ผลว่างจาก pdftohtml เป็นข้อผิดพลาด ไม่ใช่ 204
  • ขีดจำกัดการอัปโหลดบนเว็บไซต์นี้: ไฟล์ละ 500 MB โดยไฟล์ที่ใหญ่กว่าประมาณ 95 MB จะถูกส่งเป็นส่วน ๆ ส่วนเนื้อหาของคำขอ API โดยตรงหนึ่งครั้งจำกัดที่ 100 MB

ตัวอย่าง

  • บันทึกข้อความง่าย ๆ มักแตกได้ HTML หนึ่งไฟล์กับภาพสองสามไฟล์
  • PDF สแกนล้วนได้ HTML ที่ส่วนใหญ่ห่อภาพหน้าเหล่านั้น

ความเป็นส่วนตัวของเครื่องมือนี้

ไฟล์อัปโหลดผ่าน HTTPS ประมวลผลในหน่วยความจำหรือไดเรกทอรีชั่วคราวอายุสั้นบนเซิร์ฟเวอร์ของเรา และลบเมื่อผลลัพธ์พร้อม เราไม่เก็บสำเนาไว้เปิดดูภายหลัง ฝึกโมเดล หรือสร้างโปรไฟล์โฆษณา รายละเอียดการเก็บรักษาและการเปิดเผยคุกกี้ AdSense อยู่ในนโยบายความเป็นส่วนตัว

คำถามที่พบบ่อย

ทำไมผลเป็น ZIP
pdftohtml เขียน HTML พร้อมภาพที่ดึงเข้าโฟลเดอร์หนึ่ง เซิร์ฟเวอร์แพ็กโฟลเดอร์นั้น
HTML จะตรงเลย์เอาต์ PDF หรือไม่
เท่ากับโหมด `-c` ของ Poppler นิตยสารหลายคอลัมน์และเวกเตอร์จำนวนมากมักไม่ตรง
แปลงสแกนเป็นข้อความ HTML ได้ไหม
ไม่ได้ เส้นทางนี้ไม่ทำ OCR ต้องการข้อความใช้ OCR เป็น Markdown
แปลงในเบราว์เซอร์หรือไม่
ไม่ เซิร์ฟเวอร์เรียก pdftohtml

อัปเดตล่าสุด:

เรียกจากโค้ด

เครื่องมือทุกตัวบนเว็บนี้เป็น REST endpoint ธรรมดา ไม่ต้องมีบัญชีหรือคีย์ API ก็เรียกได้ ใช้ได้ทั้งเบราว์เซอร์ นักพัฒนา และเอเจนต์

curl -X POST "https://pdf123.xyz/api/v1/convert/pdf/html" \
  -F "[email protected]" \
  -o output.pdf

มีเป็นเครื่องมือ MCP สำหรับไคลเอนต์เอเจนต์ที่รองรับ Model Context Protocol (JSON-RPC 2.0 ผ่าน POST /mcp) เอกสาร API ฉบับเต็ม

ใช้งานผ่านเอเจนต์ AI

สกิล

เมื่อติดตั้งสกิลนี้ Claude Code, Codex, Cursor และเอเจนต์ AI อื่น ๆ จะใช้ "PDF เป็น HTML" แทนคุณได้: /skills/pdf123-pdf-to-html.md

สกิลสำหรับเอเจนต์ทั้งหมด

ไฟล์ใช้เฉพาะงานนี้ เสร็จแล้วลบอัตโนมัติ