खोज शब्द से PDF पृष्ठ रिडैक्ट करें
पाठ काला करें टूल उस हर पृष्ठ को ठोस काले पृष्ठ से बदल देता है जिसके पाठ में आपका कोई खोज शब्द हो। मिलान में अपर-लोअर केस नहीं गिना जाता, और रिडैक्ट पृष्ठ की पुरानी सामग्री हटा दी जाती है। यह पाठ परत पर चलता है, स्कैन पर नहीं।
फ़ाइलें यहाँ खींचकर छोड़ें, या क्लिक कर चुनें
PDF स्वीकार्य · हर फ़ाइल अधिकतम 500.0 MB · एक बार में अधिकतम 20 फ़ाइलें
आप Ctrl/Cmd+V से या क्लिपबोर्ड मेन्यू से फ़ाइल चिपका भी सकते हैं।
पाठ काला करें हर पृष्ठ का पाठ पढ़कर आपके अल्पविराम-अलग शब्दों से मिलाता है। मिलान अपर-लोअर केस की परवाह न करने वाला सबस्ट्रिंग परीक्षण है, इसलिए `acme` से `ACME Corp` भी मिल जाता है। जो भी पृष्ठ मेल खाता है, उसकी जगह ठोस काला पृष्ठ आ जाता है। यह पृष्ठ-स्तर का रिडैक्शन है, शब्द-स्तर का नहीं।
मेल खाने वाले पृष्ठ की पुरानी सामग्री, संसाधन और एनोटेशन अलग कर दिए जाते हैं, इसलिए छिपाए गए शब्द उस पृष्ठ से निकाले नहीं जा सकते। भराव काले (`#000000`) पर तय है; रंग फ़ील्ड नज़रअंदाज़ होता है।
यह टूल फ़ाइल में दूसरी जगह बचे उस अंश को भी साफ़ करता है जो रिडैक्ट पृष्ठ पीछे छोड़ता है: उस पर के फ़ॉर्म फ़ील्ड, वे बुकमार्क जो उसकी ओर इशारा करते हैं या जिनमें कोई शब्द है, मेल खाती दस्तावेज़-जानकारी प्रविष्टियाँ, रिडैक्ट पृष्ठों का XMP मेटाडेटा और संरचना-वृक्ष का पाठ। एम्बेड फ़ाइलें, JavaScript और बिना मेल वाले पृष्ठों का पाठ नहीं छुआ जाता; पहले दो को PDF साफ़ करें हटाता है।
ख़ाली शब्द-सूची त्रुटि के साथ अस्वीकार होती है। जिन पृष्ठों में कोई मेल नहीं, बिना पाठ परत वाले केवल-छवि स्कैन समेत, वे अपरिवर्तित निकलते हैं। OCR नहीं है, इसलिए स्कैन किया पृष्ठ सिर्फ़ पृष्ठ हटाएँ से ही हटाया जा सकता है।
API `caseSensitive=true` और `useRegex=true` भी स्वीकार करता है (Rust regex सिंटैक्स, अधिकतम 200 अल्पविराम-अलग शब्द)। वेबसाइट के फ़ॉर्म में सिर्फ़ शब्द-सूची है।
पासवर्ड-सुरक्षित फ़ाइलें इस पृष्ठ पर पासवर्ड डालते ही आपके लिए खोल दी जाती हैं; API उपयोगकर्ता पहले पासवर्ड हटाएँ चलाएँ।
सुविधाएँ
- शब्द मिलान अपर-लोअर केस अनदेखा करता है; हर मेल खाता पृष्ठ काला पृष्ठ बन जाता है
- पृष्ठ की पुरानी सामग्री, फ़ॉर्म फ़ील्ड, मेल खाते बुकमार्क शीर्षक और मेटाडेटा हटाता है
- ख़ाली शब्द-सूची अस्वीकार; बिना मेल वाले पृष्ठ अपरिवर्तित
- अनाम API: /api/v1/security/auto-redact
यह उपकरण कब इस्तेमाल करें
- साझा करने से पहले उन पृष्ठों को काला करना जिनमें ग्राहक का नाम या खाता संख्या है
- लंबे निर्यात से वे पृष्ठ हटाना जिनमें व्यक्तिगत पहचान-विवरण हैं
- समीक्षा के लिए ऐसी प्रति बनाना जिसके संवेदनशील पृष्ठ वापस न निकाले जा सकें
PDF के पृष्ठ कैसे रिडैक्ट करें?
- पाठ परत वाली ऐसी PDF अपलोड करें जिसे बदलने का आपको अधिकार है।
- अल्पविराम से अलग शब्द लिखें, जैसे किसी ग्राहक का नाम या खाता संख्या। मिलान अपर-लोअर केस अनदेखा करता है।
- प्रसंस्करण शुरू करें। जिस भी पृष्ठ में कोई शब्द है, वह ठोस काला पृष्ठ बन जाता है।
- नतीजा खोलें, देखें कि कौन से पृष्ठ काले हुए, और साझा करने से पहले शब्दों को एक बार फिर खोजें।
सीमाएँ और अपवाद
- सिर्फ़ पृष्ठ-स्तर; पृष्ठ पर आंशिक रिडैक्शन नहीं
- पाठ परत चाहिए: केवल-छवि पृष्ठ कभी मेल नहीं खाते
- ख़ाली शब्द-सूची एक त्रुटि है
- एम्बेड फ़ाइलें और JavaScript नहीं हटते; उनके लिए PDF साफ़ करें इस्तेमाल करें
- वेक्टर आकृतियों के रूप में बने शब्दों में मिलाने लायक पाठ नहीं होता
- इस वेबसाइट पर अपलोड सीमा: प्रति फ़ाइल 500 MB, लगभग 95 MB से ऊपर की फ़ाइलें टुकड़ों में भेजी जाती हैं। सीधे एक API अनुरोध का बॉडी अधिकतम 100 MB का हो सकता है।
उदाहरण
- शब्द secret पृष्ठ 2 को तभी काला करता है जब उस पृष्ठ के निकाले गए पाठ में secret किसी भी केस में हो
- शब्द alpha,beta उन सभी पृष्ठों को काला करते हैं जिनमें इनमें से कोई शब्द है
इस उपकरण की गोपनीयता
फ़ाइलें HTTPS पर अपलोड होती हैं, सर्वर की मेमोरी या अल्पकालिक अस्थायी निर्देशिका में संसाधित होती हैं, और परिणाम तैयार होते ही हटा दी जाती हैं। हम बाद में देखने, मॉडल प्रशिक्षण या विज्ञापन प्रोफ़ाइल के लिए प्रतियाँ नहीं रखते। प्रतिधारण अवधि और AdSense कुकी विवरण गोपनीयता नीति में हैं।
अक्सर पूछे सवाल
- पूरा पृष्ठ काला क्यों हो गया?
- रिडैक्शन पृष्ठ-स्तर का है। जिस भी पृष्ठ के पाठ में कोई शब्द है, उसकी जगह काला पृष्ठ आ जाता है, इसलिए उस पर कुछ नहीं बचता।
- क्या मैं एक शब्द रिडैक्ट करके बाक़ी पृष्ठ रख सकता हूँ?
- नहीं। पूरा मेल खाता पृष्ठ काला होता है; शब्द-स्तर पर बॉक्स रिडैक्शन नहीं है।
- क्या पाठ सचमुच फ़ाइल से हट जाता है?
- मेल खाते पृष्ठों पर सामग्री, संसाधन और एनोटेशन बदल दिए जाते हैं, इसलिए पाठ अब पृष्ठ में नहीं रहता। फ़ॉर्म के मान, मेल खाते बुकमार्क शीर्षक, Info प्रविष्टियाँ और मेटाडेटा भी साफ़ होते हैं। एम्बेड फ़ाइलें और बिना मेल वाले पृष्ठ जस के तस रहते हैं।
- क्या मिलान अपर-लोअर केस पर निर्भर है?
- नहीं। डिफ़ॉल्ट रूप से शब्द अक्षरों के केस की परवाह किए बिना मिलते हैं। API उपयोगकर्ता caseSensitive=true, या रेगुलर एक्सप्रेशन के लिए useRegex=true भेज सकते हैं।
- क्या पाठ काला करें स्कैन किए दस्तावेज़ को संभाल सकता है?
- सीधे नहीं। यह पाठ परत पढ़ता है, और जिस स्कैन में वह नहीं है वह अपरिवर्तित रहता है। कोई OCR चरण नहीं है।
आख़िरी अपडेट:
कोड से कॉल करें
यहाँ हर उपकरण एक सादा REST एंडपॉइंट है। गुमनाम इस्तेमाल के लिए खाता या API कुंजी नहीं चाहिए। ब्राउज़र, डेवलपर और AI एजेंट, तीनों के लिए।
curl -X POST "https://pdf123.xyz/api/v1/security/auto-redact" \
-F "[email protected]" \
-F "listOfText=your-listOfText" \
-o output.pdfModel Context Protocol बोलने वाले एजेंट क्लाइंट के लिए MCP उपकरण भी है (JSON-RPC 2.0, POST /mcp)। पूरा API संदर्भ
AI एजेंट से इस्तेमाल करें
स्किलइस स्किल से Claude Code, Codex, Cursor और दूसरे AI एजेंट आपके लिए “पाठ काला करें” चला सकते हैं: /skills/pdf123-auto-redact.md
फ़ाइलें केवल इस काम के लिए इस्तेमाल होती हैं, फिर अपने आप मिट जाती हैं।