Xóa trang trống khỏi tệp PDF
Xóa trang trống phân loại các trang của PDF thành trang trống và không trống rồi trả về thành các PDF riêng trong một ZIP. Trang được coi là trống khi không có chữ trích xuất được và không có ảnh nhúng.
Kéo tệp vào đây, hoặc nhấp để chọn
Nhận PDF · tối đa 500.0 MB mỗi tệp · tối đa 20 tệp mỗi lần
Bạn cũng có thể dán tệp bằng Ctrl/Cmd+V hoặc từ menu clipboard.
Xóa trang trống phân loại mỗi trang thành trống hoặc không trống, rồi trả ZIP tập con qpdf. Một trang coi là trống khi không có chữ trích xuất được và không có ảnh nhúng, nên trang chỉ có đường kẻ vector cũng bị coi là trống. Trường `threshold` không ảnh hưởng đến trang có bất kỳ chữ nào, còn `whitePercent` được đọc rồi bỏ.
Có cả hai loại thì nhận `{base}_blank.pdf` và `{base}_nonblank.pdf`. Toàn trống thì `{base}_allBlankPages.pdf`. Toàn không trống thì `nonblank.pdf`.
Đây không phải phát hiện trang trắng nhìn, cũng không OCR. Biểu mẫu quét là một ảnh sẽ bị coi không trống vì `page_has_images` đúng. Trang chỉ đường vector, không chữ, nhìn như đã in vẫn có thể bị coi trống.
Tệp có mật khẩu được mở khóa giúp bạn ngay trên trang này khi bạn nhập mật khẩu; người gọi API chạy Gỡ mật khẩu trước.
Tải lên là tạm thời. Chúng tôi không lưu thư viện PDF của bạn.
Tính năng
- Heuristic chữ cộng ảnh; tập con trống và/hoặc không trống đóng ZIP
- `whitePercent` bị bỏ qua; `threshold` không ảnh hưởng đến trang có chữ
- Bản quét thuần ảnh coi là không trống
- API ẩn danh: /api/v1/misc/remove-blanks
Khi nào nên dùng
- Từ bản xuất điện tử lấy tờ phân cách không chữ
- Dù trông trắng, vẫn giữ các trang ảnh quét cùng nhau
- Trước khi xóa gì, hãy xem cả hai tệp trong ZIP
Làm thế nào để xóa trang trống khỏi PDF?
- Tải lên PDF.
- Để nguyên threshold và whitePercent; cả hai đều không đổi việc trang có chữ hay ảnh nào được giữ.
- Nhấp xử lý, tải `{name}_removeBlanks.zip`.
- Nếu có hai phần thì mở cả hai, xác nhận trang có ảnh nằm ở không trống.
Giới hạn và ngoại lệ
- Không phải phát hiện trống nhìn
- Không OCR
- whitePercent vô hiệu
- Giới hạn tải lên trên trang web này: 500 MB mỗi tệp, tệp lớn hơn khoảng 95 MB được gửi theo từng phần. Một yêu cầu API trực tiếp bị giới hạn ở 100 MB.
Ví dụ
- Vài trang văn bản trống cộng một ảnh quét cho một tệp trống và một tệp không trống một trang
- Bản quét toàn ảnh trong ZIP thường chỉ có nonblank.pdf
Quyền riêng tư của công cụ này
Tệp được tải lên qua HTTPS, xử lý trong bộ nhớ hoặc thư mục tạm ngắn hạn trên máy chủ của chúng tôi, rồi bị xóa khi kết quả sẵn sàng. Chúng tôi không giữ bản sao để xem lại sau, huấn luyện mô hình hay lập hồ sơ quảng cáo. Thời hạn lưu giữ và cookie AdSense nằm trong Chính sách quyền riêng tư.
Câu hỏi thường gặp
- Vì sao trang quét trông trắng vẫn còn?
- Nó chứa ảnh XObject. Bộ phân loại coi mọi trang có ảnh là không trống.
- whitePercent 99.9 có ích không?
- Không. Mã gắn rồi bỏ qua.
- Đầu ra có phải một PDF đã xóa trang trống không?
- Không. Là ZIP có thể chứa tệp trống và không trống.
- OCR rồi mới xóa trang trống được không?
- OCR trả về Markdown, không phải PDF gửi được vào đây.
Cập nhật lần cuối:
Gọi bằng mã
Mỗi công cụ trên trang là một API REST thông thường. Dùng ẩn danh không cần tài khoản hay API key. Trình duyệt, lập trình viên và agent đều gọi được.
curl -X POST "https://pdf123.xyz/api/v1/misc/remove-blanks" \
-F "[email protected]" \
-F "threshold=10" \
-F "whitePercent=99.9" \
-o output.pdfCũng có dạng công cụ MCP cho client dùng Model Context Protocol (JSON-RPC 2.0, POST /mcp). Tài liệu API đầy đủ
Dùng từ AI agent
SkillVới skill này, Claude Code, Codex, Cursor và các AI agent khác có thể chạy "Xóa trang trống" thay bạn: /skills/pdf123-remove-blanks.md
Tệp chỉ dùng cho lần xử lý này, xong là tự xóa.