ดึงภาพออกจาก PDF
ดึงภาพออก คือเครื่องมือที่ดึงภาพแรสเตอร์ที่ฝังอยู่ใน PDF แล้วส่งมอบเป็นไฟล์ PNG หรือ JPEG ใน ZIP ภาพวาดเวกเตอร์และข้อความบนหน้าไม่ใช่ภาพ จึงไม่รวมอยู่ด้วย
ลากไฟล์มาที่นี่ หรือคลิกเพื่อเลือก
รองรับ PDF · ไม่เกิน 500.0 MB ต่อไฟล์ · สูงสุด 20 ไฟล์ต่อครั้ง
คุณวางไฟล์ด้วย Ctrl/Cmd+V หรือจากเมนูคลิปบอร์ดได้เช่นกัน
การดึงภาพออกไล่ภาพ XObject ในหน้า ถอดรหัสสตรีม Flate/ASCII85/DCT แล้วแพ็กเป็น ZIP ของ `image_N.png` หรือ `image_N.jpeg` `format` เลือก png (ค่าเริ่มต้น) หรือ jpeg XObject ที่ใช้ร่วมกันถูกดึงครั้งเดียว
ภาพกรอง LZW คืนข้อผิดพลาดภายใน (`LZW images unsupported`) หน้าไม่มีพจนานุกรม XObject ถูกข้าม ไฟล์ไม่มีภาพที่ดึงได้ยังคืน ZIP ซึ่งอาจไม่มีสมาชิกที่ต้องการ
นี่ไม่ใช่การเรนเดอร์ทุกหน้าเป็น PNG (นั่นคือ PDF เป็นภาพ) และไม่ใช่ OCR เวกเตอร์ไม่ใช่ภาพ XObject จะไม่ปรากฏ
ไฟล์ที่มีรหัสผ่านจะถูกปลดล็อกให้ในหน้านี้เมื่อคุณใส่รหัสผ่าน ส่วนผู้เรียก API ให้รันถอดรหัสผ่านก่อน
ความสามารถ
- ภาพ XObject แพ็กเป็น ZIP ของ PNG หรือ JPEG
- ตัดซ้ำตาม object id ไม่รองรับ LZW
- ไม่ใช่การแรสเตอร์ทั้งหน้า และไม่ใช่ OCR
- API แบบไม่ระบุตัวตน: /api/v1/misc/extract-images
ใช้เมื่อไหร่
- ดึงภาพถ่ายจากรายงานอิเล็กทรอนิกส์
- เมื่อ format=jpeg พยายามไม่เข้ารหัสสตรีม JPEG ใหม่
- เมื่อต้องการแค่ภาพ ไม่ต้องการแรสเตอร์ทั้งหน้า
ดึงภาพออกจากไฟล์ PDF ได้อย่างไร
- อัปโหลด PDF ที่มีภาพถ่ายหรือแรสเตอร์ฝัง
- คง PNG หรือเลือก JPEG
- คลิกเริ่มประมวลผล แล้วดาวน์โหลด `{name}_extracted_images.zip`
- ถ้าใน ZIP ไม่มีไฟล์ที่ใช้ได้ แปลว่า PDF ไม่มีภาพ XObject ที่ถอดรหัสได้
ข้อจำกัดและกรณีพิเศษ
- ไม่ใช่ตัวเรนเดอร์หน้า
- LZW ทำให้งานล้มเหลว
- ผลลัพธ์ PNG เป็น RGB จึงทิ้งความโปร่งใสและซอฟต์มาสก์
- ไม่มี OCR
- ขีดจำกัดการอัปโหลดบนเว็บไซต์นี้: ไฟล์ละ 500 MB โดยไฟล์ที่ใหญ่กว่าประมาณ 95 MB จะถูกส่งเป็นส่วน ๆ ส่วนเนื้อหาของคำขอ API โดยตรงหนึ่งครั้งจำกัดที่ 100 MB
ตัวอย่าง
- PDF มีภาพ XObject ไม่ซ้ำสามภาพ ZIP ได้ image_1 ถึง image_3
- หน้าโลโก้เวกเตอร์อาจไม่ให้ภาพใดเลย
ความเป็นส่วนตัวของเครื่องมือนี้
ไฟล์อัปโหลดผ่าน HTTPS ประมวลผลในหน่วยความจำหรือไดเรกทอรีชั่วคราวอายุสั้นบนเซิร์ฟเวอร์ของเรา และลบเมื่อผลลัพธ์พร้อม เราไม่เก็บสำเนาไว้เปิดดูภายหลัง ฝึกโมเดล หรือสร้างโปรไฟล์โฆษณา รายละเอียดการเก็บรักษาและการเปิดเผยคุกกี้ AdSense อยู่ในนโยบายความเป็นส่วนตัว
คำถามที่พบบ่อย
- ทำไมไม่ใช่หนึ่งภาพต่อหน้า
- ดึงเฉพาะภาพ XObject ที่ฝัง หน้าข้อความบวกเวกเตอร์อาจไม่มีภาพเลย
- ต่างจาก PDF เป็นภาพอย่างไร
- PDF เป็นภาพเรนเดอร์หน้า การดึงภาพออกนำอ็อบเจ็กต์ภาพที่มีอยู่แล้วในไฟล์ออกมา
- LZW ล่ะ
- ยังไม่ถอดรหัส LZW งานจะผิดพลาด ไม่ใช่ข้ามภาพนั้น
- จัดการ mask และ SMask หรือไม่
- ถือว่าเป็นการส่งออกพิกเซลเท่าที่ทำได้ ซอฟต์มาสก์และปริภูมิสีน้อยพบอาจไม่ถูกต้อง
อัปเดตล่าสุด:
เรียกจากโค้ด
เครื่องมือทุกตัวบนเว็บนี้เป็น REST endpoint ธรรมดา ไม่ต้องมีบัญชีหรือคีย์ API ก็เรียกได้ ใช้ได้ทั้งเบราว์เซอร์ นักพัฒนา และเอเจนต์
curl -X POST "https://pdf123.xyz/api/v1/misc/extract-images" \
-F "[email protected]" \
-F "format=png" \
-o output.pdfมีเป็นเครื่องมือ MCP สำหรับไคลเอนต์เอเจนต์ที่รองรับ Model Context Protocol (JSON-RPC 2.0 ผ่าน POST /mcp) เอกสาร API ฉบับเต็ม
ใช้งานผ่านเอเจนต์ AI
สกิลเมื่อติดตั้งสกิลนี้ Claude Code, Codex, Cursor และเอเจนต์ AI อื่น ๆ จะใช้ "ดึงภาพออก" แทนคุณได้: /skills/pdf123-extract-images.md
ไฟล์ใช้เฉพาะงานนี้ เสร็จแล้วลบอัตโนมัติ