Lewati ke konten utama
PPDF123

Sensor Halaman PDF Menurut Kata Pencarian

Coret hitam mengganti setiap halaman yang teksnya memuat salah satu kata pencarian Anda dengan halaman hitam pekat. Pencocokan tidak membedakan huruf besar dan kecil, dan isi lama halaman yang disensor dihapus. Alat ini bekerja pada lapisan teks, bukan pindaian.

Seret file ke sini, atau klik untuk memilih

Menerima PDF · maksimal 500.0 MB per file · hingga 20 file sekaligus

Anda juga dapat menempelkan file dengan Ctrl/Cmd+V atau dari menu papan klip.

Coret hitam membaca teks setiap halaman dan membandingkannya dengan istilah Anda yang dipisah koma. Pencocokan berupa uji substring tanpa membedakan huruf besar-kecil, jadi `acme` juga cocok dengan `ACME Corp`. Setiap halaman yang cocok diganti dengan halaman hitam pekat. Ini redaksi tingkat halaman, bukan tingkat kata.

Pada halaman yang cocok, konten lama, sumber daya, dan anotasi dilepas, sehingga kata yang disembunyikan tidak dapat diekstrak dari halaman itu. Warna isian dikunci hitam (`#000000`); kolom warna diabaikan.

Alat ini juga membersihkan sisa yang ditinggalkan halaman tersensor di bagian lain berkas: isian formulir di halaman itu, penanda buku yang menunjuk ke sana atau memuat istilah, entri informasi dokumen yang cocok, metadata XMP halaman tersensor, dan teks pohon struktur. Berkas tertanam, JavaScript, dan teks pada halaman yang tidak cocok tidak disentuh; Bersihkan PDF menghapus dua yang pertama.

Daftar istilah kosong ditolak dengan galat. Halaman tanpa kecocokan, termasuk pindaian berupa gambar tanpa lapisan teks, keluar tanpa perubahan. Tidak ada OCR, jadi halaman hasil pindai hanya bisa dibuang dengan Hapus halaman.

API juga menerima `caseSensitive=true` dan `useRegex=true` (sintaks regex Rust, paling banyak 200 istilah dipisah koma). Formulir situs hanya memiliki daftar istilah.

Berkas yang dilindungi kata sandi dibuka untuk Anda di halaman ini setelah Anda memasukkan kata sandinya; pengguna API harus menjalankan Hapus kata sandi lebih dulu.

Fitur

  • Pencocokan istilah tanpa membedakan huruf besar-kecil; setiap halaman yang cocok menjadi halaman hitam
  • Membuang konten lama halaman, isian formulir, judul penanda buku yang cocok, dan metadata
  • Daftar istilah kosong ditolak; halaman tanpa kecocokan tidak berubah
  • API anonim: /api/v1/security/auto-redact

Kapan memakai alat ini

  • Menghitamkan halaman yang menyebut nama klien atau nomor rekening sebelum dibagikan
  • Membuang halaman berisi pengenal pribadi dari ekspor yang panjang
  • Menyiapkan salinan tinjauan yang halaman sensitifnya tidak boleh bisa dipulihkan

Bagaimana cara menyensor halaman dalam PDF?

  1. Unggah PDF berlapisan teks yang berhak Anda ubah.
  2. Tulis istilah dipisah koma, misalnya nama klien atau nomor rekening. Pencocokan mengabaikan huruf besar-kecil.
  3. Klik Proses. Setiap halaman yang memuat istilah menjadi halaman hitam pekat.
  4. Buka hasilnya, periksa halaman mana yang menjadi hitam, dan cari sekali lagi istilah itu sebelum membagikannya.

Batasan dan kasus khusus

  • Hanya tingkat halaman; tidak ada redaksi sebagian pada satu halaman
  • Perlu lapisan teks: halaman berupa gambar tidak pernah cocok
  • Daftar istilah kosong adalah galat
  • Berkas tertanam dan JavaScript tidak dihapus; gunakan Bersihkan PDF untuk itu
  • Kata yang digambar sebagai bentuk vektor tidak punya teks untuk dicocokkan
  • Batas unggah di situs ini: 500 MB per berkas, dikirim bertahap (per potongan) di atas sekitar 95 MB. Satu permintaan API langsung dibatasi 100 MB.

Contoh

  • Istilah secret menghitamkan halaman 2 hanya bila teks yang diekstrak dari halaman itu memuat secret dengan huruf besar-kecil apa pun
  • Istilah alpha,beta menghitamkan setiap halaman yang memuat salah satu kata itu

Privasi alat ini

File diunggah lewat HTTPS, diproses di memori atau direktori sementara singkat di server kami, lalu dihapus saat hasil siap. Kami tidak menyimpan salinan untuk ditelusuri nanti, pelatihan, atau profil iklan. Lihat Kebijakan Privasi untuk retensi dan pengungkapan cookie AdSense.

Pertanyaan umum

Mengapa seluruh halaman menjadi hitam?
Redaksi dilakukan di tingkat halaman. Setiap halaman yang teksnya memuat istilah diganti halaman hitam, sehingga tidak ada isinya yang bertahan.
Bisakah saya menyensor satu kata dan mempertahankan sisa halaman?
Tidak. Seluruh halaman yang cocok dihitamkan; tidak ada redaksi kotak tingkat kata.
Apakah teksnya benar-benar dihapus dari berkas?
Pada halaman yang cocok, konten, sumber daya, dan anotasi diganti, sehingga teks tidak lagi ada di halaman itu. Nilai isian formulir, judul penanda buku yang cocok, entri Info, dan metadata juga dibersihkan. Berkas tertanam dan halaman yang tidak cocok dibiarkan.
Apakah pencocokan membedakan huruf besar-kecil?
Tidak. Secara bawaan istilah cocok tanpa memandang huruf besar-kecil. Pemanggil API dapat mengirim caseSensitive=true, atau useRegex=true untuk ekspresi reguler.
Bisakah Coret hitam menangani dokumen hasil pindai?
Tidak langsung. Alat ini membaca lapisan teks, dan pindaian tanpa lapisan itu dibiarkan. Tidak ada langkah OCR.

Terakhir diperbarui:

Panggil dari kode

Setiap alat di situs ini adalah antarmuka REST biasa. Pemakaian anonim tidak butuh akun atau kunci API. Bisa dipakai dari browser, oleh pengembang, maupun agen AI.

curl -X POST "https://pdf123.xyz/api/v1/security/auto-redact" \
  -F "[email protected]" \
  -F "listOfText=your-listOfText" \
  -o output.pdf

Juga tersedia sebagai alat MCP untuk klien agen yang memakai Model Context Protocol (JSON-RPC 2.0 lewat POST /mcp). Referensi API lengkap

Gunakan dari agen AI

Skill

Dengan skill ini, Claude Code, Codex, Cursor, dan agen AI lainnya bisa menjalankan "Coret hitam" untuk Anda: /skills/pdf123-auto-redact.md

Semua skill agen

File hanya dipakai untuk pemrosesan ini, lalu dihapus otomatis.