แปลง PDF เป็น HTML
PDF เป็น HTML คือเครื่องมือที่แปลง PDF ด้วย pdftohtml ของ Poppler แล้วส่ง ZIP ที่มีหน้า HTML และภาพของหน้า เป็นการถ่ายทอดเลย์เอาต์ ไม่ใช่มาร์กอัปเว็บที่สะอาด และไม่ทำ OCR
ลากไฟล์มาที่นี่ หรือคลิกเพื่อเลือก
รองรับ PDF · ไม่เกิน 500.0 MB ต่อไฟล์ · สูงสุด 20 ไฟล์ต่อครั้ง
คุณวางไฟล์ด้วย Ctrl/Cmd+V หรือจากเมนูคลิปบอร์ดได้เช่นกัน
การแปลง PDF เป็น HTML รัน Poppler `pdftohtml -c` แล้วแพ็กเนื้อหาที่เครื่องมือเขียนลงไดเรกทอรีผลเป็น ZIP ชื่อดาวน์โหลดเป็น `{base}ToHtml.zip` ไม่ใช่ `.html` เดี่ยว เป้าหมายไม่ใช่ CSS ระดับเบราว์เซอร์ แต่เป็นการส่งออก HTML และภาพของ Poppler
หน้านี้ไม่มีฟิลด์ฟอร์ม แปลงทุกหน้า ถ้า `pdftohtml` ไม่เขียนอะไร อินเทอร์เฟซคืนข้อผิดพลาดภายใน ไม่ใช่ ZIP ว่าง
นี่ไม่ใช่ OCR สแกนภาพล้วนกลายเป็นภาพในแพ็ก HTML ไม่ใช่ข้อความเลือกได้ ไฟล์ที่มีรหัสผ่านจะถูกปลดล็อกให้ในหน้านี้เมื่อคุณใส่รหัสผ่าน ส่วนผู้เรียก API ให้รันถอดรหัสผ่านก่อน
ถ้าต้องการแค่ข้อความ ใช้ PDF เป็นข้อความ ถ้าต้องการบทความสำหรับ CMS ใช้ PDF เป็น Markdown
ความสามารถ
- Poppler `pdftohtml -c` ผลเป็น ZIP ของ HTML และทรัพยากร
- ไม่มีตัวเลือกช่วงหน้าหรือธีม
- ไม่ใช่ OCR สแกนในแพ็กยังเป็นภาพ
- API แบบไม่ระบุตัวตน: /api/v1/convert/pdf/html
ใช้เมื่อไหร่
- ได้ HTML หยาบจาก PDF ที่มีชั้นข้อความ
- นำภาพหน้าที่ pdftohtml ดึงออกไปใช้
- ดูก่อนว่า Poppler อ่านไฟล์นี้อย่างไร ก่อนทำท่อเอง
แปลง PDF เป็น HTML ได้อย่างไร
- อัปโหลด PDF หน้านี้ไม่มีตัวเลือกการแปลง
- คลิกเริ่มประมวลผล แล้วดาวน์โหลด `{name}ToHtml.zip`
- แตกไฟล์แล้วเปิด HTML ในเบราว์เซอร์
- ตรวจภาพและข้อความ สแกนจะไม่กลายเป็นข้อความ HTML จริง
ข้อจำกัดและกรณีพิเศษ
- ผลเป็น ZIP ไม่ใช่ HTML เดี่ยว
- ไม่ใช่การพิมพ์ Chromium และไม่ใช่การส่งออก HTML จาก tagged-PDF
- ผลว่างจาก pdftohtml เป็นข้อผิดพลาด ไม่ใช่ 204
- ขีดจำกัดการอัปโหลดบนเว็บไซต์นี้: ไฟล์ละ 500 MB โดยไฟล์ที่ใหญ่กว่าประมาณ 95 MB จะถูกส่งเป็นส่วน ๆ ส่วนเนื้อหาของคำขอ API โดยตรงหนึ่งครั้งจำกัดที่ 100 MB
ตัวอย่าง
- บันทึกข้อความง่าย ๆ มักแตกได้ HTML หนึ่งไฟล์กับภาพสองสามไฟล์
- PDF สแกนล้วนได้ HTML ที่ส่วนใหญ่ห่อภาพหน้าเหล่านั้น
ความเป็นส่วนตัวของเครื่องมือนี้
ไฟล์อัปโหลดผ่าน HTTPS ประมวลผลในหน่วยความจำหรือไดเรกทอรีชั่วคราวอายุสั้นบนเซิร์ฟเวอร์ของเรา และลบเมื่อผลลัพธ์พร้อม เราไม่เก็บสำเนาไว้เปิดดูภายหลัง ฝึกโมเดล หรือสร้างโปรไฟล์โฆษณา รายละเอียดการเก็บรักษาและการเปิดเผยคุกกี้ AdSense อยู่ในนโยบายความเป็นส่วนตัว
คำถามที่พบบ่อย
- ทำไมผลเป็น ZIP
- pdftohtml เขียน HTML พร้อมภาพที่ดึงเข้าโฟลเดอร์หนึ่ง เซิร์ฟเวอร์แพ็กโฟลเดอร์นั้น
- HTML จะตรงเลย์เอาต์ PDF หรือไม่
- เท่ากับโหมด `-c` ของ Poppler นิตยสารหลายคอลัมน์และเวกเตอร์จำนวนมากมักไม่ตรง
- แปลงสแกนเป็นข้อความ HTML ได้ไหม
- ไม่ได้ เส้นทางนี้ไม่ทำ OCR ต้องการข้อความใช้ OCR เป็น Markdown
- แปลงในเบราว์เซอร์หรือไม่
- ไม่ เซิร์ฟเวอร์เรียก pdftohtml
อัปเดตล่าสุด:
เรียกจากโค้ด
เครื่องมือทุกตัวบนเว็บนี้เป็น REST endpoint ธรรมดา ไม่ต้องมีบัญชีหรือคีย์ API ก็เรียกได้ ใช้ได้ทั้งเบราว์เซอร์ นักพัฒนา และเอเจนต์
curl -X POST "https://pdf123.xyz/api/v1/convert/pdf/html" \
-F "[email protected]" \
-o output.pdfมีเป็นเครื่องมือ MCP สำหรับไคลเอนต์เอเจนต์ที่รองรับ Model Context Protocol (JSON-RPC 2.0 ผ่าน POST /mcp) เอกสาร API ฉบับเต็ม
ใช้งานผ่านเอเจนต์ AI
สกิลเมื่อติดตั้งสกิลนี้ Claude Code, Codex, Cursor และเอเจนต์ AI อื่น ๆ จะใช้ "PDF เป็น HTML" แทนคุณได้: /skills/pdf123-pdf-to-html.md
ไฟล์ใช้เฉพาะงานนี้ เสร็จแล้วลบอัตโนมัติ