PDF के कुछ ही पृष्ठ भेजें: पृष्ठ निकालें, पृष्ठ हटाएँ, और पीछे क्या रह जाता है
PDF के कुछ ही पृष्ठ भेजने के लिए पृष्ठ निकालें में रखने वाले पृष्ठ लिखें, या पृष्ठ हटाएँ में छोड़ने वाले पृष्ठ। पृष्ठ का पाठ हट जाता है, पर बुकमार्क के शीर्षक और दस्तावेज़ का शीर्षक फ़ाइल में रह सकते हैं।
पृष्ठ निकालें 12 पृष्ठ की PDF से एक नई PDF बनाता है जिसमें केवल वही पृष्ठ होते हैं जो आप लिखते हैं, जैसे 1,3,5-8। पृष्ठ हटाएँ इसका उलटा करता है: आप वे पृष्ठ लिखते हैं जिन्हें छोड़ना है। दोनों मूल पृष्ठों को दोबारा बनाने के बजाय उनकी नक़ल करते हैं, इसलिए पाठ चुना जा सकता है और फ़ाइल धुंधली नहीं होती। एक सीमा तब मायने रखती है जब छोड़े गए पृष्ठ संवेदनशील हों: पृष्ठ की सामग्री चली जाती है, पर बुकमार्क के शीर्षक और दस्तावेज़ का शीर्षक नई फ़ाइल में रह सकते हैं।
जो आपको पहले से पता है, उसके हिसाब से उपकरण चुनें
अगर आपको रखने वाले पृष्ठ पता हैं, तो पृष्ठ निकालें इस्तेमाल करें। अगर छोड़ने वाले पृष्ठ पता हैं, तो पृष्ठ हटाएँ। फ़र्क़ नतीजे के क्रम में दिखता है:
- पृष्ठ निकालें पृष्ठों को उसी क्रम में लिखता है जिसमें आपने टाइप किया।
5,1,3टाइप करने पर पहले पृष्ठ 5, फिर पृष्ठ 1, फिर पृष्ठ 3 आता है। दो बार टाइप किया गया पृष्ठ एक ही बार आता है। - पृष्ठ हटाएँ बचे हुए पृष्ठों को उनके मूल क्रम में रखता है।
पृष्ठ संख्याएँ वही हैं जो व्यूअर दिखाता है, 1 से शुरू। दोनों उपकरणों में सूची लिखने का तरीक़ा एक है: एकल पृष्ठ (4), सीमाएँ (5-8), अल्पविराम से अलग सूचियाँ (1,3,5-8), शब्द all, और 2n+1 जैसे व्यंजक। व्यंजक में n 1 से गिना जाता है, इसलिए 2n+1 से पृष्ठ 3, 5, 7 और इसी तरह आगे के आते हैं; पृष्ठ 1 शामिल नहीं होता, इसलिए उसे चाहें तो 1,2n+1 टाइप करें।
एक पूरा उदाहरण: मकान मालिक को लीज़ का एक हिस्सा भेजना
इनपुट 12 पृष्ठ की लेटर-आकार की लीज़ है। हर पृष्ठ पर उसकी अपनी संख्या पाठ के रूप में छपी है ("Lease agreement - page 3 of 12"), इसलिए नतीजा जाँचना आसान है। मकान मालिक को पृष्ठ 1, 3 और 5 से 8 चाहिए, परिशिष्ट नहीं। ब्राउज़र में आप फ़ाइल अपलोड करते हैं, 1,3,5-8 टाइप करते हैं और नतीजा डाउनलोड करते हैं। स्क्रिप्ट से यही ऑपरेशन यह है:
curl -s -o pages.pdf \
-F [email protected] \
-F pageNumbers="1,3,5-8" \
https://pdf123.xyz/api/v1/general/rearrange-pages
वेबसाइट का उपकरण सूची को इसी एंडपॉइंट पर भेजता है और customMode को तय नहीं करता, जिसका मतलब है "मेरी सूची को मेरे क्रम में इस्तेमाल करो"। ये नतीजे 2026-10-04 को एक स्थानीय सर्वर के विरुद्ध एक बार चलाने के हैं, जनरेट की गई परीक्षण फ़ाइल के साथ; संख्याएँ पृष्ठों की गिनती हैं और आउटपुट से निकाले गए पृष्ठ लेबल:
| उपकरण को दिया गया इनपुट | उपकरण | नतीजे में पृष्ठ |
|---|---|---|
1,3,5-8 |
पृष्ठ निकालें | 6 पृष्ठ: 1, 3, 5, 6, 7, 8 |
5,1,3,1 |
पृष्ठ निकालें | 3 पृष्ठ: 5, 1, 3 |
2n+1 |
पृष्ठ निकालें | 5 पृष्ठ: 3, 5, 7, 9, 11 |
10-15 |
पृष्ठ निकालें | 3 पृष्ठ: 10, 11, 12 |
2-4,9 |
पृष्ठ हटाएँ | 8 पृष्ठ: 1, 5, 6, 7, 8, 10, 11, 12 |
| खाली (केवल API; वेब फ़ॉर्म में मान ज़रूरी है) | पृष्ठ हटाएँ | सभी 12 पृष्ठ, मूल फ़ाइल वापस |
डाउनलोड की गई फ़ाइल का नाम वही रहता है जो आपने अपलोड की गई फ़ाइल का रखा था, इसलिए भेजने से पहले नाम बदल लें, वरना डिस्क पर दो lease.pdf हो जाएँगी।
तीन इनपुट जो विफल होते हैं, और त्रुटि क्या कहती है
जो पृष्ठ मौजूद नहीं है, वह चुपचाप छोड़ा नहीं जाता, त्रुटि बनता है। 12 पृष्ठ की फ़ाइल में पृष्ठ 13 माँगने पर 400 (page_out_of_range) लौटता है, संदेश Page 13 does not exist; the document has 12 pages. के साथ। पृष्ठ 0 भी इसी तरह अस्वीकार होता है। जो पाठ पृष्ठ सूची नहीं है, जैसे abc, उस पर 400 और invalid_page_selection लौटता है, साथ में 1,3,5-8 या all जैसे मान इस्तेमाल करने का संकेत। यहाँ दोनों उपकरण एक जैसा व्यवहार करते हैं, इसलिए टाइपो से ऐसी फ़ाइल नहीं बनती जो ठीक दिखे पर ग़लत हो।
दो किनारे के मामले कम स्पष्ट हैं। जो सीमा दस्तावेज़ के भीतर शुरू होकर उसके बाहर ख़त्म होती है, उसे काट दिया जाता है: 12 पृष्ठ पर 10-15 से पृष्ठ 10 से 12 मिले। और पृष्ठ हटाएँ सब कुछ हटाने से मना कर देता है: 1-12 पर 400 (would remove every page, which leaves nothing to return) लौटता है, क्योंकि बिना पृष्ठ की PDF हो ही नहीं सकती।
पासवर्ड से सुरक्षित फ़ाइल के लिए वेब पेज पर उसका पासवर्ड चाहिए। अगर आप API सीधे बुलाते हैं, तो पहले पासवर्ड हटाएँ चलाएँ।
पीछे क्या रह जाता है: पृष्ठ हटाना उसे काला करना नहीं है
निकालने की प्रक्रिया पृष्ठ ऑब्जेक्ट छोड़ देती है, और उनके साथ उन पृष्ठों का पाठ और छवियाँ भी जो आपने सूची में नहीं रखे। परीक्षण में निकाली गई फ़ाइल में छोड़े गए पृष्ठों का कोई पाठ नहीं था। पर वह उन पृष्ठों का ज़िक्र करने वाली हर चीज़ नहीं छोड़ती। मेरी परीक्षण फ़ाइल में रखे गए पृष्ठों के बाइट में भी छोड़े गए पाठ का कोई निशान नहीं था।
इस जाँच के लिए लीज़ में एक दस्तावेज़ शीर्षक ("Lease - Unit 4B, J. Rivera") और दो बुकमार्क थे: पृष्ठ 1 पर "Signature page" और पृष्ठ 12 पर "Tenant SSN appendix"। पृष्ठ निकालें से पृष्ठ 1 और 2 रखने के बाद फ़ाइल में 2 पृष्ठ थे, और व्यूअर के बुकमार्क पैनल में दोनों शीर्षक अब भी दिखे; दूसरा अब कहीं नहीं ले जाता था। शीर्षक और लेखक दस्तावेज़ के गुणों में अब भी थे। पृष्ठ 12 पर पृष्ठ हटाएँ चलाने के बाद भी वही दोनों बुकमार्क रहे।
मेटाडेटा विकल्प चालू रखकर PDF साफ़ करें दस्तावेज़ की जानकारी और XMP मेटाडेटा मिटा देता है, और उसके बाद दस्तावेज़ के गुण ख़ाली मिले। वेब फ़ॉर्म में ये विकल्प डिफ़ॉल्ट रूप से चालू होते हैं; API कॉल को removeMetadata=true ख़ुद भेजना पड़ता है। PDF साफ़ करें बुकमार्क को नहीं छूता: दोनों शीर्षक तब भी मौजूद थे। कोई वेब उपकरण बुकमार्क संपादित नहीं करता। API का ऑपरेशन general/edit-table-of-contents उन्हें JSON सूची से बदल देता है, और उसे कम से कम एक प्रविष्टि चाहिए, इसलिए वह सूची को केवल ख़ाली नहीं कर सकता। परीक्षण में उसने पुराने शीर्षक का पाठ फ़ाइल के भीतर बिना संदर्भ वाले ऑब्जेक्ट के रूप में छोड़ दिया, जो व्यूअर में नहीं दिखता पर कच्चे बाइट में पढ़ा जा सकता है। बुकमार्क शीर्षक छिपाने के लिए इस पर भरोसा न करें।
इसलिए जब छोड़े गए पृष्ठ संवेदनशील थे, तो नतीजा खोलें, बुकमार्क पैनल और दस्तावेज़ के गुण देखें, और तभी भेजें जब उनमें कुछ भी सामग्री उजागर न करता हो। अगर बुकमार्क का शीर्षक ही गोपनीय है, तो यह रास्ता उसे नहीं हटा सकता। अगर रखे गए पृष्ठ पर दिखने वाला कोई शब्द हटाना है, तो वह पाठ काला करें का काम है, जिसकी चर्चा साझा करने से पहले में है।
लागत और सीमाएँ
- दोनों उपकरण एक बार में एक PDF पर काम करते हैं और एक PDF बनाते हैं। फ़ाइल को कई हिस्सों में काटना PDF बाँटें का काम है।
- नतीजा एक नई फ़ाइल है और आपकी मूल फ़ाइल अछूती रहती है। मूल फ़ाइल रखें, क्योंकि नई फ़ाइल छोड़े गए पृष्ठ वापस नहीं दे सकती।
- जो फ़ाइल खुलती ही नहीं, उसके लिए पहले PDF सुधारें चाहिए; देखें फ़ाइल नहीं खुलती।