Chuyển đến nội dung chính
PPDF123

Trích ảnh từ tệp PDF

Trích ảnh lấy các ảnh raster nhúng ra khỏi PDF và giao trong một ZIP dưới dạng tệp PNG hoặc JPEG. Hình vẽ vector và chữ của trang không phải ảnh nên không có trong đó.

Kéo tệp vào đây, hoặc nhấp để chọn

Nhận PDF · tối đa 500.0 MB mỗi tệp · tối đa 20 tệp mỗi lần

Bạn cũng có thể dán tệp bằng Ctrl/Cmd+V hoặc từ menu clipboard.

Trích ảnh duyệt ảnh XObject trang, giải mã luồng Flate/ASCII85/DCT, đóng thành ZIP `image_N.png` hoặc `image_N.jpeg`. `format` chọn png (mặc định) hoặc jpeg. XObject dùng chung chỉ trích một lần.

Ảnh lọc LZW trả lỗi nội bộ (`LZW images unsupported`). Trang không có từ điển XObject bị bỏ qua. Tệp không có ảnh trích được vẫn trả ZIP, có thể không có thành viên bạn muốn.

Đây không phải render mọi trang thành PNG (đó là PDF sang ảnh), cũng không phải OCR. Vector không phải XObject ảnh nên không xuất hiện.

Tệp có mật khẩu được mở khóa giúp bạn ngay trên trang này khi bạn nhập mật khẩu; người gọi API chạy Gỡ mật khẩu trước.

Tải lên là tạm thời. Chúng tôi không lưu thư viện ảnh của bạn.

Tính năng

  • Ảnh XObject đóng ZIP PNG hoặc JPEG
  • Khử trùng theo object id; không hỗ trợ LZW
  • Không raster cả trang, cũng không OCR
  • API ẩn danh: /api/v1/misc/extract-images

Khi nào nên dùng

  • Trích ảnh từ báo cáo điện tử
  • Khi format=jpeg cố gắng không mã hóa lại luồng ảnh JPEG
  • Chỉ cần ảnh, không muốn raster cả trang

Làm thế nào để trích ảnh từ PDF?

  1. Tải lên PDF nhúng ảnh hoặc đồ họa raster.
  2. Giữ PNG, hoặc chọn JPEG.
  3. Nhấp Bắt đầu xử lý, tải `{name}_extracted_images.zip`.
  4. Nếu ZIP không có tệp hữu ích, PDF không có XObject ảnh giải mã được.

Giới hạn và ngoại lệ

  • Không phải bộ render trang
  • LZW làm tác vụ thất bại
  • Đầu ra PNG là RGB nên độ trong suốt và mặt nạ mềm bị bỏ
  • Không OCR
  • Giới hạn tải lên trên trang web này: 500 MB mỗi tệp, tệp lớn hơn khoảng 95 MB được gửi theo từng phần. Một yêu cầu API trực tiếp bị giới hạn ở 100 MB.

Ví dụ

  • PDF có ba XObject ảnh không trùng thành image_1 đến image_3 trong ZIP
  • Trang logo vector có thể không đóng góp gì

Quyền riêng tư của công cụ này

Tệp được tải lên qua HTTPS, xử lý trong bộ nhớ hoặc thư mục tạm ngắn hạn trên máy chủ của chúng tôi, rồi bị xóa khi kết quả sẵn sàng. Chúng tôi không giữ bản sao để duyệt sau, huấn luyện hay lập hồ sơ quảng cáo. Thời hạn lưu giữ và thông báo cookie AdSense nằm trong Chính sách quyền riêng tư.

Câu hỏi thường gặp

Vì sao không phải mỗi trang một ảnh?
Chỉ trích XObject ảnh nhúng. Trang chữ cộng vector có thể không có ảnh nào.
Khác PDF sang ảnh thế nào?
PDF sang ảnh render trang. Trích ảnh lấy đối tượng ảnh đã có trong tệp.
Còn LZW?
Giải mã LZW chưa có. Tác vụ báo lỗi, không bỏ qua ảnh đó.
Mask và SMask có xử lý không?
Coi đầu ra là xuất pixel hết sức. Soft mask và không gian màu hiếm có thể sai.

Cập nhật lần cuối:

Gọi bằng mã

Mỗi công cụ trên trang là một API REST thông thường. Dùng ẩn danh không cần tài khoản hay API key. Trình duyệt, lập trình viên và agent đều gọi được.

curl -X POST "https://pdf123.xyz/api/v1/misc/extract-images" \
  -F "[email protected]" \
  -F "format=png" \
  -o output.pdf

Cũng có dạng công cụ MCP cho client dùng Model Context Protocol (JSON-RPC 2.0, POST /mcp). Tài liệu API đầy đủ

Dùng từ AI agent

Skill

Với skill này, Claude Code, Codex, Cursor và các AI agent khác có thể chạy "Trích ảnh" thay bạn: /skills/pdf123-extract-images.md

Tất cả skill cho agent

Tệp chỉ dùng cho lần xử lý này, xong là tự xóa.