Chuyển đến nội dung chính
PPDF123

Xóa trang trống khỏi tệp PDF

Xóa trang trống phân loại các trang của PDF thành trang trống và không trống rồi trả về thành các PDF riêng trong một ZIP. Trang được coi là trống khi không có chữ trích xuất được và không có ảnh nhúng.

Kéo tệp vào đây, hoặc nhấp để chọn

Nhận PDF · tối đa 500.0 MB mỗi tệp · tối đa 20 tệp mỗi lần

Bạn cũng có thể dán tệp bằng Ctrl/Cmd+V hoặc từ menu clipboard.

Xóa trang trống phân loại mỗi trang thành trống hoặc không trống, rồi trả ZIP tập con qpdf. Một trang coi là trống khi không có chữ trích xuất được và không có ảnh nhúng, nên trang chỉ có đường kẻ vector cũng bị coi là trống. Trường `threshold` không ảnh hưởng đến trang có bất kỳ chữ nào, còn `whitePercent` được đọc rồi bỏ.

Có cả hai loại thì nhận `{base}_blank.pdf` và `{base}_nonblank.pdf`. Toàn trống thì `{base}_allBlankPages.pdf`. Toàn không trống thì `nonblank.pdf`.

Đây không phải phát hiện trang trắng nhìn, cũng không OCR. Biểu mẫu quét là một ảnh sẽ bị coi không trống vì `page_has_images` đúng. Trang chỉ đường vector, không chữ, nhìn như đã in vẫn có thể bị coi trống.

Tệp có mật khẩu được mở khóa giúp bạn ngay trên trang này khi bạn nhập mật khẩu; người gọi API chạy Gỡ mật khẩu trước.

Tải lên là tạm thời. Chúng tôi không lưu thư viện PDF của bạn.

Tính năng

  • Heuristic chữ cộng ảnh; tập con trống và/hoặc không trống đóng ZIP
  • `whitePercent` bị bỏ qua; `threshold` không ảnh hưởng đến trang có chữ
  • Bản quét thuần ảnh coi là không trống
  • API ẩn danh: /api/v1/misc/remove-blanks

Khi nào nên dùng

  • Từ bản xuất điện tử lấy tờ phân cách không chữ
  • Dù trông trắng, vẫn giữ các trang ảnh quét cùng nhau
  • Trước khi xóa gì, hãy xem cả hai tệp trong ZIP

Làm thế nào để xóa trang trống khỏi PDF?

  1. Tải lên PDF.
  2. Để nguyên threshold và whitePercent; cả hai đều không đổi việc trang có chữ hay ảnh nào được giữ.
  3. Nhấp xử lý, tải `{name}_removeBlanks.zip`.
  4. Nếu có hai phần thì mở cả hai, xác nhận trang có ảnh nằm ở không trống.

Giới hạn và ngoại lệ

  • Không phải phát hiện trống nhìn
  • Không OCR
  • whitePercent vô hiệu
  • Giới hạn tải lên trên trang web này: 500 MB mỗi tệp, tệp lớn hơn khoảng 95 MB được gửi theo từng phần. Một yêu cầu API trực tiếp bị giới hạn ở 100 MB.

Ví dụ

  • Vài trang văn bản trống cộng một ảnh quét cho một tệp trống và một tệp không trống một trang
  • Bản quét toàn ảnh trong ZIP thường chỉ có nonblank.pdf

Quyền riêng tư của công cụ này

Tệp được tải lên qua HTTPS, xử lý trong bộ nhớ hoặc thư mục tạm ngắn hạn trên máy chủ của chúng tôi, rồi bị xóa khi kết quả sẵn sàng. Chúng tôi không giữ bản sao để xem lại sau, huấn luyện mô hình hay lập hồ sơ quảng cáo. Thời hạn lưu giữ và cookie AdSense nằm trong Chính sách quyền riêng tư.

Câu hỏi thường gặp

Vì sao trang quét trông trắng vẫn còn?
Nó chứa ảnh XObject. Bộ phân loại coi mọi trang có ảnh là không trống.
whitePercent 99.9 có ích không?
Không. Mã gắn rồi bỏ qua.
Đầu ra có phải một PDF đã xóa trang trống không?
Không. Là ZIP có thể chứa tệp trống và không trống.
OCR rồi mới xóa trang trống được không?
OCR trả về Markdown, không phải PDF gửi được vào đây.

Cập nhật lần cuối:

Gọi bằng mã

Mỗi công cụ trên trang là một API REST thông thường. Dùng ẩn danh không cần tài khoản hay API key. Trình duyệt, lập trình viên và agent đều gọi được.

curl -X POST "https://pdf123.xyz/api/v1/misc/remove-blanks" \
  -F "[email protected]" \
  -F "threshold=10" \
  -F "whitePercent=99.9" \
  -o output.pdf

Cũng có dạng công cụ MCP cho client dùng Model Context Protocol (JSON-RPC 2.0, POST /mcp). Tài liệu API đầy đủ

Dùng từ AI agent

Skill

Với skill này, Claude Code, Codex, Cursor và các AI agent khác có thể chạy "Xóa trang trống" thay bạn: /skills/pdf123-remove-blanks.md

Tất cả skill cho agent

Tệp chỉ dùng cho lần xử lý này, xong là tự xóa.