Bôi đen trang PDF theo từ tìm kiếm
Bôi đen chữ thay mọi trang có chữ chứa một trong các từ khóa của bạn bằng một trang đen kín. Không phân biệt hoa thường, và nội dung cũ của trang bị bôi đen được gỡ đi. Công cụ chạy trên lớp chữ, không dành cho bản quét.
Kéo tệp vào đây, hoặc nhấp để chọn
Nhận PDF · tối đa 500.0 MB mỗi tệp · tối đa 20 tệp mỗi lần
Bạn cũng có thể dán tệp bằng Ctrl/Cmd+V hoặc từ menu clipboard.
Bôi đen chữ đọc chữ của từng trang và so với các từ khóa cách nhau bằng dấu phẩy của bạn. Khớp là kiểm tra chuỗi con không phân biệt hoa thường, nên `acme` cũng trúng `ACME Corp`. Mỗi trang khớp bị thay bằng một trang đen kín. Đây là bôi đen cấp trang, không phải cấp từ.
Ở trang khớp, nội dung cũ, tài nguyên và chú thích bị tách ra, nên không thể trích các từ bị ẩn khỏi trang đó. Màu phủ cố định là đen (`#000000`); trường màu bị bỏ qua.
Công cụ cũng dọn những gì trang bị bôi đen để lại ở nơi khác trong tệp: trường biểu mẫu trên trang, dấu trang trỏ tới trang hoặc chứa từ khóa, mục thông tin tài liệu khớp, siêu dữ liệu XMP của các trang bị bôi đen và chữ trong cây cấu trúc. Tệp nhúng, JavaScript và chữ trên các trang không khớp không bị đụng tới; Dọn PDF gỡ hai thứ đầu.
Danh sách từ khóa trống bị từ chối kèm lỗi. Trang không khớp, kể cả bản quét chỉ có ảnh và không có lớp chữ, được giữ nguyên. Không có OCR, nên trang quét chỉ có thể bị loại bằng Xóa trang.
API còn nhận `caseSensitive=true` và `useRegex=true` (cú pháp regex của Rust, tối đa 200 từ khóa cách nhau bằng dấu phẩy). Biểu mẫu web chỉ có danh sách từ khóa.
Tệp có mật khẩu được mở khóa giúp bạn ngay trên trang này khi bạn nhập mật khẩu; người gọi API chạy Gỡ mật khẩu trước.
Tính năng
- Khớp từ khóa không phân biệt hoa thường; mỗi trang khớp thành trang đen
- Gỡ nội dung cũ của trang, trường biểu mẫu, tiêu đề dấu trang khớp và siêu dữ liệu
- Danh sách từ khóa trống bị từ chối; trang không khớp được giữ nguyên
- API ẩn danh: /api/v1/security/auto-redact
Khi nào nên dùng
- Bôi đen các trang nhắc tên khách hàng hoặc số tài khoản trước khi chia sẻ
- Loại các trang chứa thông tin định danh cá nhân khỏi một bản xuất dài
- Chuẩn bị bản duyệt mà các trang nhạy cảm không được khôi phục lại
Làm thế nào để bôi đen các trang trong PDF?
- Tải lên PDF có lớp chữ mà bạn có quyền sửa.
- Nhập các từ khóa cách nhau bằng dấu phẩy, ví dụ tên khách hàng hoặc số tài khoản. Không phân biệt hoa thường.
- Nhấp xử lý. Mỗi trang có từ khóa trở thành trang đen kín.
- Mở kết quả, kiểm tra trang nào đã đen, rồi tìm lại các từ khóa một lần nữa trước khi chia sẻ.
Giới hạn và ngoại lệ
- Chỉ cấp trang; không bôi đen một phần trên trang
- Cần lớp chữ: trang chỉ có ảnh không bao giờ khớp
- Danh sách từ khóa trống là lỗi
- Tệp nhúng và JavaScript không bị gỡ; dùng Dọn PDF cho những thứ đó
- Chữ vẽ bằng hình vector không có chữ để khớp
- Giới hạn tải lên trên trang web này: 500 MB mỗi tệp, tệp lớn hơn khoảng 95 MB được gửi theo từng phần. Một yêu cầu API trực tiếp bị giới hạn ở 100 MB.
Ví dụ
- Từ khóa secret chỉ bôi đen trang 2 khi chữ trích xuất của trang đó chứa secret, viết hoa thế nào cũng được
- Các từ khóa alpha,beta bôi đen mọi trang chứa một trong hai từ
Quyền riêng tư của công cụ này
Tệp được tải lên qua HTTPS, xử lý trong bộ nhớ hoặc thư mục tạm ngắn hạn trên máy chủ của chúng tôi, rồi bị xóa khi kết quả sẵn sàng. Chúng tôi không giữ bản sao để duyệt sau, huấn luyện hay lập hồ sơ quảng cáo. Thời hạn lưu giữ và thông báo cookie AdSense nằm trong Chính sách quyền riêng tư.
Câu hỏi thường gặp
- Vì sao cả trang đen?
- Bôi đen ở cấp trang. Mọi trang có chữ chứa từ khóa đều được thay bằng trang đen, nên không còn gì sót lại trên đó.
- Che một từ, giữ phần còn lại của trang được không?
- Không. Cả trang khớp bị bôi đen; không có che theo khung ở cấp từ.
- Chữ có thật sự bị xóa khỏi tệp không?
- Ở các trang khớp, nội dung, tài nguyên và chú thích bị thay, nên chữ không còn trong trang. Giá trị biểu mẫu, tiêu đề dấu trang khớp, mục Info và siêu dữ liệu cũng được dọn. Tệp nhúng và các trang không khớp được để nguyên.
- Có phân biệt hoa thường không?
- Không. Mặc định từ khóa khớp bất kể viết hoa. Người gọi API có thể gửi caseSensitive=true, hoặc useRegex=true để dùng biểu thức chính quy.
- Bôi đen chữ có xử lý được tài liệu quét không?
- Không trực tiếp. Công cụ đọc lớp chữ, còn bản quét không có lớp đó thì được giữ nguyên. Không có bước OCR.
Cập nhật lần cuối:
Gọi bằng mã
Mỗi công cụ trên trang là một API REST thông thường. Dùng ẩn danh không cần tài khoản hay API key. Trình duyệt, lập trình viên và agent đều gọi được.
curl -X POST "https://pdf123.xyz/api/v1/security/auto-redact" \
-F "[email protected]" \
-F "listOfText=your-listOfText" \
-o output.pdfCũng có dạng công cụ MCP cho client dùng Model Context Protocol (JSON-RPC 2.0, POST /mcp). Tài liệu API đầy đủ
Dùng từ AI agent
SkillVới skill này, Claude Code, Codex, Cursor và các AI agent khác có thể chạy "Bôi đen chữ" thay bạn: /skills/pdf123-auto-redact.md
Tệp chỉ dùng cho lần xử lý này, xong là tự xóa.