PDF को पाठ में बदलें
PDF से RTF (पाठ) टूल PDF में पहले से मौजूद पाठ निकालकर सादी .txt फ़ाइल या RTF में लौटाता है। यह OCR नहीं चलाता, इसलिए सिर्फ़ चित्र वाले स्कैन ख़ाली आते हैं।
फ़ाइलें यहाँ खींचकर छोड़ें, या क्लिक कर चुनें
PDF स्वीकार्य · हर फ़ाइल अधिकतम 500.0 MB · एक बार में अधिकतम 20 फ़ाइलें
आप Ctrl/Cmd+V से या क्लिपबोर्ड मेन्यू से फ़ाइल चिपका भी सकते हैं।
PDF से RTF (पाठ) उन शब्दों को निकालता है जो पहले से पाठ वस्तु के रूप में मौजूद हैं। डिफ़ॉल्ट `txt` पथ अन्य pdf-core संक्रियाओं जैसा स्थानीय निष्कर्षक (`pdfio::extract_text`) इस्तेमाल करता है और `text/plain` लौटाता है। OCR नहीं चलता, LibreOffice भी नहीं बुलाया जाता।
`rtf` चुनने पर फ़ाइल LibreOffice `writer_pdf_import` से गुज़रती है। उस पथ को सर्वर पर `soffice` चाहिए, और एक मोटा रिच टेक्स्ट बनता है। फ़ॉन्ट प्रतिस्थापन और टेबल विस्थापन आम हैं। RTF को मसौदा मानें।
शुद्ध छवि स्कैन खाली या लगभग खाली `.txt` देते हैं। इस साइट का OCR Markdown लौटाता है, न कि यहाँ फिर भेज सकने योग्य खोज-योग्य PDF।
इस पृष्ठ पर पृष्ठ-सीमा फ़ील्ड नहीं। हर पृष्ठ पढ़ा जाता है। पासवर्ड-सुरक्षित फ़ाइलें इस पृष्ठ पर पासवर्ड डालते ही आपके लिए खोल दी जाती हैं; API उपयोगकर्ता पहले पासवर्ड हटाएँ चलाएँ।
शीर्षक और सूचियाँ चाहिए, शुद्ध पाठ नहीं, तो PDF से Markdown। तालिकाएँ पंक्तियों में चाहिए तो PDF से CSV या PDF से Excel।
अपलोड अस्थायी हैं। हम आपकी पाठ लाइब्रेरी नहीं रखते।
सुविधाएँ
- डिफ़ॉल्ट TXT स्थानीय पाठ निष्कर्षण; pdftotext नहीं, OCR नहीं
- वैकल्पिक RTF, LibreOffice `writer_pdf_import` से
- हर पृष्ठ पढ़ता है; पृष्ठ-सीमा पैरामीटर नहीं
- अनाम API: /api/v1/convert/pdf/text
यह उपकरण कब इस्तेमाल करें
- पाठ परत वाली रिपोर्ट grep या स्क्रिप्ट में डालना
- इलेक्ट्रॉनिक मेमो से मोटा RTF मसौदा
- जाँचना कि PDF में पाठ परत है या नहीं
PDF से पाठ कैसे निकालें?
- चयनयोग्य पाठ वाली PDF अपलोड करें।
- TXT रखें, या LibreOffice रिच टेक्स्ट मसौदा चाहिए तो RTF चुनें।
- प्रसंस्करण शुरू करें, `.txt` या `.rtf` डाउनलोड करें।
- कुछ अनुच्छेद जाँचें। बिना पाठ परत के स्कैन खाली लगते हैं।
सीमाएँ और अपवाद
- OCR नहीं; स्कैन से लगभग शब्द नहीं निकलते
- पृष्ठ-सीमा नियंत्रण नहीं
- TXT बहु-स्तंभ दृश्य पढ़ने का क्रम नहीं बनाता
- इस वेबसाइट पर अपलोड सीमा: प्रति फ़ाइल 500 MB, लगभग 95 MB से ऊपर की फ़ाइलें टुकड़ों में भेजी जाती हैं। सीधे एक API अनुरोध का बॉडी अधिकतम 100 MB का हो सकता है।
उदाहरण
- चयनयोग्य वार्षिक रिपोर्ट से अक्सर लंबी .txt मिलती है
- व्हाइटबोर्ड फ़ोटो PDF आमतौर पर खाली या बहुत छोटी फ़ाइल देती है
इस उपकरण की गोपनीयता
फ़ाइलें HTTPS पर अपलोड होती हैं, सर्वर की मेमोरी या अल्पकालिक अस्थायी निर्देशिका में संसाधित होती हैं, और परिणाम तैयार होते ही हटा दी जाती हैं। हम बाद में देखने, मॉडल प्रशिक्षण या विज्ञापन प्रोफ़ाइल के लिए प्रतियाँ नहीं रखते। प्रतिधारण अवधि और AdSense कुकी विवरण गोपनीयता नीति में हैं।
अक्सर पूछे सवाल
- पाठ फ़ाइल खाली क्यों है?
- PDF में निष्कर्षक के लिए पाठ वस्तुएँ नहीं। स्कैन को OCR से Markdown चाहिए। वह Markdown यहाँ फिर नहीं भेज सकते।
- TXT रीडर से कॉपी जैसा ही है?
- करीब, लेकिन एक जैसा नहीं। क्रम पृष्ठ सामग्री धारा में पाठ के भंडारण का अनुसरण करता है। बहु-स्तंभ लेआउट दृश्य पढ़ने के क्रम से अलग हो सकता है।
- RTF कब चुनें?
- केवल जब LibreOffice दस्तावेज़ पुनर्निर्माण चाहिए। TXT सीधा निष्कर्षण है; soffice नहीं चाहिए।
- फ़ॉन्ट और लेआउट बचते हैं?
- TXT शुद्ध पाठ है। RTF सीमित पुनर्निर्माण है, पिक्सेल-स्तरीय मेल नहीं।
आख़िरी अपडेट:
कोड से कॉल करें
यहाँ हर उपकरण एक सादा REST एंडपॉइंट है। गुमनाम इस्तेमाल के लिए खाता या API कुंजी नहीं चाहिए। ब्राउज़र, डेवलपर और AI एजेंट, तीनों के लिए।
curl -X POST "https://pdf123.xyz/api/v1/convert/pdf/text" \
-F "[email protected]" \
-F "outputFormat=txt" \
-o output.pdfModel Context Protocol बोलने वाले एजेंट क्लाइंट के लिए MCP उपकरण भी है (JSON-RPC 2.0, POST /mcp)। पूरा API संदर्भ
AI एजेंट से इस्तेमाल करें
स्किलइस स्किल से Claude Code, Codex, Cursor और दूसरे AI एजेंट आपके लिए “PDF से RTF (पाठ)” चला सकते हैं: /skills/pdf123-pdf-to-text.md
फ़ाइलें केवल इस काम के लिए इस्तेमाल होती हैं, फिर अपने आप मिट जाती हैं।