मुख्य सामग्री पर जाएँ
PPDF123

खोज शब्द से PDF पृष्ठ रिडैक्ट करें

पाठ काला करें टूल उस हर पृष्ठ को ठोस काले पृष्ठ से बदल देता है जिसके पाठ में आपका कोई खोज शब्द हो। मिलान में अपर-लोअर केस नहीं गिना जाता, और रिडैक्ट पृष्ठ की पुरानी सामग्री हटा दी जाती है। यह पाठ परत पर चलता है, स्कैन पर नहीं।

फ़ाइलें यहाँ खींचकर छोड़ें, या क्लिक कर चुनें

PDF स्वीकार्य · हर फ़ाइल अधिकतम 500.0 MB · एक बार में अधिकतम 20 फ़ाइलें

आप Ctrl/Cmd+V से या क्लिपबोर्ड मेन्यू से फ़ाइल चिपका भी सकते हैं।

पाठ काला करें हर पृष्ठ का पाठ पढ़कर आपके अल्पविराम-अलग शब्दों से मिलाता है। मिलान अपर-लोअर केस की परवाह न करने वाला सबस्ट्रिंग परीक्षण है, इसलिए `acme` से `ACME Corp` भी मिल जाता है। जो भी पृष्ठ मेल खाता है, उसकी जगह ठोस काला पृष्ठ आ जाता है। यह पृष्ठ-स्तर का रिडैक्शन है, शब्द-स्तर का नहीं।

मेल खाने वाले पृष्ठ की पुरानी सामग्री, संसाधन और एनोटेशन अलग कर दिए जाते हैं, इसलिए छिपाए गए शब्द उस पृष्ठ से निकाले नहीं जा सकते। भराव काले (`#000000`) पर तय है; रंग फ़ील्ड नज़रअंदाज़ होता है।

यह टूल फ़ाइल में दूसरी जगह बचे उस अंश को भी साफ़ करता है जो रिडैक्ट पृष्ठ पीछे छोड़ता है: उस पर के फ़ॉर्म फ़ील्ड, वे बुकमार्क जो उसकी ओर इशारा करते हैं या जिनमें कोई शब्द है, मेल खाती दस्तावेज़-जानकारी प्रविष्टियाँ, रिडैक्ट पृष्ठों का XMP मेटाडेटा और संरचना-वृक्ष का पाठ। एम्बेड फ़ाइलें, JavaScript और बिना मेल वाले पृष्ठों का पाठ नहीं छुआ जाता; पहले दो को PDF साफ़ करें हटाता है।

ख़ाली शब्द-सूची त्रुटि के साथ अस्वीकार होती है। जिन पृष्ठों में कोई मेल नहीं, बिना पाठ परत वाले केवल-छवि स्कैन समेत, वे अपरिवर्तित निकलते हैं। OCR नहीं है, इसलिए स्कैन किया पृष्ठ सिर्फ़ पृष्ठ हटाएँ से ही हटाया जा सकता है।

API `caseSensitive=true` और `useRegex=true` भी स्वीकार करता है (Rust regex सिंटैक्स, अधिकतम 200 अल्पविराम-अलग शब्द)। वेबसाइट के फ़ॉर्म में सिर्फ़ शब्द-सूची है।

पासवर्ड-सुरक्षित फ़ाइलें इस पृष्ठ पर पासवर्ड डालते ही आपके लिए खोल दी जाती हैं; API उपयोगकर्ता पहले पासवर्ड हटाएँ चलाएँ।

सुविधाएँ

  • शब्द मिलान अपर-लोअर केस अनदेखा करता है; हर मेल खाता पृष्ठ काला पृष्ठ बन जाता है
  • पृष्ठ की पुरानी सामग्री, फ़ॉर्म फ़ील्ड, मेल खाते बुकमार्क शीर्षक और मेटाडेटा हटाता है
  • ख़ाली शब्द-सूची अस्वीकार; बिना मेल वाले पृष्ठ अपरिवर्तित
  • अनाम API: /api/v1/security/auto-redact

यह उपकरण कब इस्तेमाल करें

  • साझा करने से पहले उन पृष्ठों को काला करना जिनमें ग्राहक का नाम या खाता संख्या है
  • लंबे निर्यात से वे पृष्ठ हटाना जिनमें व्यक्तिगत पहचान-विवरण हैं
  • समीक्षा के लिए ऐसी प्रति बनाना जिसके संवेदनशील पृष्ठ वापस न निकाले जा सकें

PDF के पृष्ठ कैसे रिडैक्ट करें?

  1. पाठ परत वाली ऐसी PDF अपलोड करें जिसे बदलने का आपको अधिकार है।
  2. अल्पविराम से अलग शब्द लिखें, जैसे किसी ग्राहक का नाम या खाता संख्या। मिलान अपर-लोअर केस अनदेखा करता है।
  3. प्रसंस्करण शुरू करें। जिस भी पृष्ठ में कोई शब्द है, वह ठोस काला पृष्ठ बन जाता है।
  4. नतीजा खोलें, देखें कि कौन से पृष्ठ काले हुए, और साझा करने से पहले शब्दों को एक बार फिर खोजें।

सीमाएँ और अपवाद

  • सिर्फ़ पृष्ठ-स्तर; पृष्ठ पर आंशिक रिडैक्शन नहीं
  • पाठ परत चाहिए: केवल-छवि पृष्ठ कभी मेल नहीं खाते
  • ख़ाली शब्द-सूची एक त्रुटि है
  • एम्बेड फ़ाइलें और JavaScript नहीं हटते; उनके लिए PDF साफ़ करें इस्तेमाल करें
  • वेक्टर आकृतियों के रूप में बने शब्दों में मिलाने लायक पाठ नहीं होता
  • इस वेबसाइट पर अपलोड सीमा: प्रति फ़ाइल 500 MB, लगभग 95 MB से ऊपर की फ़ाइलें टुकड़ों में भेजी जाती हैं। सीधे एक API अनुरोध का बॉडी अधिकतम 100 MB का हो सकता है।

उदाहरण

  • शब्द secret पृष्ठ 2 को तभी काला करता है जब उस पृष्ठ के निकाले गए पाठ में secret किसी भी केस में हो
  • शब्द alpha,beta उन सभी पृष्ठों को काला करते हैं जिनमें इनमें से कोई शब्द है

इस उपकरण की गोपनीयता

फ़ाइलें HTTPS पर अपलोड होती हैं, सर्वर की मेमोरी या अल्पकालिक अस्थायी निर्देशिका में संसाधित होती हैं, और परिणाम तैयार होते ही हटा दी जाती हैं। हम बाद में देखने, मॉडल प्रशिक्षण या विज्ञापन प्रोफ़ाइल के लिए प्रतियाँ नहीं रखते। प्रतिधारण अवधि और AdSense कुकी विवरण गोपनीयता नीति में हैं।

अक्सर पूछे सवाल

पूरा पृष्ठ काला क्यों हो गया?
रिडैक्शन पृष्ठ-स्तर का है। जिस भी पृष्ठ के पाठ में कोई शब्द है, उसकी जगह काला पृष्ठ आ जाता है, इसलिए उस पर कुछ नहीं बचता।
क्या मैं एक शब्द रिडैक्ट करके बाक़ी पृष्ठ रख सकता हूँ?
नहीं। पूरा मेल खाता पृष्ठ काला होता है; शब्द-स्तर पर बॉक्स रिडैक्शन नहीं है।
क्या पाठ सचमुच फ़ाइल से हट जाता है?
मेल खाते पृष्ठों पर सामग्री, संसाधन और एनोटेशन बदल दिए जाते हैं, इसलिए पाठ अब पृष्ठ में नहीं रहता। फ़ॉर्म के मान, मेल खाते बुकमार्क शीर्षक, Info प्रविष्टियाँ और मेटाडेटा भी साफ़ होते हैं। एम्बेड फ़ाइलें और बिना मेल वाले पृष्ठ जस के तस रहते हैं।
क्या मिलान अपर-लोअर केस पर निर्भर है?
नहीं। डिफ़ॉल्ट रूप से शब्द अक्षरों के केस की परवाह किए बिना मिलते हैं। API उपयोगकर्ता caseSensitive=true, या रेगुलर एक्सप्रेशन के लिए useRegex=true भेज सकते हैं।
क्या पाठ काला करें स्कैन किए दस्तावेज़ को संभाल सकता है?
सीधे नहीं। यह पाठ परत पढ़ता है, और जिस स्कैन में वह नहीं है वह अपरिवर्तित रहता है। कोई OCR चरण नहीं है।

आख़िरी अपडेट:

कोड से कॉल करें

यहाँ हर उपकरण एक सादा REST एंडपॉइंट है। गुमनाम इस्तेमाल के लिए खाता या API कुंजी नहीं चाहिए। ब्राउज़र, डेवलपर और AI एजेंट, तीनों के लिए।

curl -X POST "https://pdf123.xyz/api/v1/security/auto-redact" \
  -F "[email protected]" \
  -F "listOfText=your-listOfText" \
  -o output.pdf

Model Context Protocol बोलने वाले एजेंट क्लाइंट के लिए MCP उपकरण भी है (JSON-RPC 2.0, POST /mcp)। पूरा API संदर्भ

AI एजेंट से इस्तेमाल करें

स्किल

इस स्किल से Claude Code, Codex, Cursor और दूसरे AI एजेंट आपके लिए “पाठ काला करें” चला सकते हैं: /skills/pdf123-auto-redact.md

सभी एजेंट स्किल

फ़ाइलें केवल इस काम के लिए इस्तेमाल होती हैं, फिर अपने आप मिट जाती हैं।