मुख्य सामग्री पर जाएँ
PPDF123

PDF को पाठ में बदलें

PDF से RTF (पाठ) टूल PDF में पहले से मौजूद पाठ निकालकर सादी .txt फ़ाइल या RTF में लौटाता है। यह OCR नहीं चलाता, इसलिए सिर्फ़ चित्र वाले स्कैन ख़ाली आते हैं।

फ़ाइलें यहाँ खींचकर छोड़ें, या क्लिक कर चुनें

PDF स्वीकार्य · हर फ़ाइल अधिकतम 500.0 MB · एक बार में अधिकतम 20 फ़ाइलें

आप Ctrl/Cmd+V से या क्लिपबोर्ड मेन्यू से फ़ाइल चिपका भी सकते हैं।

PDF से RTF (पाठ) उन शब्दों को निकालता है जो पहले से पाठ वस्तु के रूप में मौजूद हैं। डिफ़ॉल्ट `txt` पथ अन्य pdf-core संक्रियाओं जैसा स्थानीय निष्कर्षक (`pdfio::extract_text`) इस्तेमाल करता है और `text/plain` लौटाता है। OCR नहीं चलता, LibreOffice भी नहीं बुलाया जाता।

`rtf` चुनने पर फ़ाइल LibreOffice `writer_pdf_import` से गुज़रती है। उस पथ को सर्वर पर `soffice` चाहिए, और एक मोटा रिच टेक्स्ट बनता है। फ़ॉन्ट प्रतिस्थापन और टेबल विस्थापन आम हैं। RTF को मसौदा मानें।

शुद्ध छवि स्कैन खाली या लगभग खाली `.txt` देते हैं। इस साइट का OCR Markdown लौटाता है, न कि यहाँ फिर भेज सकने योग्य खोज-योग्य PDF।

इस पृष्ठ पर पृष्ठ-सीमा फ़ील्ड नहीं। हर पृष्ठ पढ़ा जाता है। पासवर्ड-सुरक्षित फ़ाइलें इस पृष्ठ पर पासवर्ड डालते ही आपके लिए खोल दी जाती हैं; API उपयोगकर्ता पहले पासवर्ड हटाएँ चलाएँ।

शीर्षक और सूचियाँ चाहिए, शुद्ध पाठ नहीं, तो PDF से Markdown। तालिकाएँ पंक्तियों में चाहिए तो PDF से CSV या PDF से Excel।

अपलोड अस्थायी हैं। हम आपकी पाठ लाइब्रेरी नहीं रखते।

सुविधाएँ

  • डिफ़ॉल्ट TXT स्थानीय पाठ निष्कर्षण; pdftotext नहीं, OCR नहीं
  • वैकल्पिक RTF, LibreOffice `writer_pdf_import` से
  • हर पृष्ठ पढ़ता है; पृष्ठ-सीमा पैरामीटर नहीं
  • अनाम API: /api/v1/convert/pdf/text

यह उपकरण कब इस्तेमाल करें

  • पाठ परत वाली रिपोर्ट grep या स्क्रिप्ट में डालना
  • इलेक्ट्रॉनिक मेमो से मोटा RTF मसौदा
  • जाँचना कि PDF में पाठ परत है या नहीं

PDF से पाठ कैसे निकालें?

  1. चयनयोग्य पाठ वाली PDF अपलोड करें।
  2. TXT रखें, या LibreOffice रिच टेक्स्ट मसौदा चाहिए तो RTF चुनें।
  3. प्रसंस्करण शुरू करें, `.txt` या `.rtf` डाउनलोड करें।
  4. कुछ अनुच्छेद जाँचें। बिना पाठ परत के स्कैन खाली लगते हैं।

सीमाएँ और अपवाद

  • OCR नहीं; स्कैन से लगभग शब्द नहीं निकलते
  • पृष्ठ-सीमा नियंत्रण नहीं
  • TXT बहु-स्तंभ दृश्य पढ़ने का क्रम नहीं बनाता
  • इस वेबसाइट पर अपलोड सीमा: प्रति फ़ाइल 500 MB, लगभग 95 MB से ऊपर की फ़ाइलें टुकड़ों में भेजी जाती हैं। सीधे एक API अनुरोध का बॉडी अधिकतम 100 MB का हो सकता है।

उदाहरण

  • चयनयोग्य वार्षिक रिपोर्ट से अक्सर लंबी .txt मिलती है
  • व्हाइटबोर्ड फ़ोटो PDF आमतौर पर खाली या बहुत छोटी फ़ाइल देती है

इस उपकरण की गोपनीयता

फ़ाइलें HTTPS पर अपलोड होती हैं, सर्वर की मेमोरी या अल्पकालिक अस्थायी निर्देशिका में संसाधित होती हैं, और परिणाम तैयार होते ही हटा दी जाती हैं। हम बाद में देखने, मॉडल प्रशिक्षण या विज्ञापन प्रोफ़ाइल के लिए प्रतियाँ नहीं रखते। प्रतिधारण अवधि और AdSense कुकी विवरण गोपनीयता नीति में हैं।

अक्सर पूछे सवाल

पाठ फ़ाइल खाली क्यों है?
PDF में निष्कर्षक के लिए पाठ वस्तुएँ नहीं। स्कैन को OCR से Markdown चाहिए। वह Markdown यहाँ फिर नहीं भेज सकते।
TXT रीडर से कॉपी जैसा ही है?
करीब, लेकिन एक जैसा नहीं। क्रम पृष्ठ सामग्री धारा में पाठ के भंडारण का अनुसरण करता है। बहु-स्तंभ लेआउट दृश्य पढ़ने के क्रम से अलग हो सकता है।
RTF कब चुनें?
केवल जब LibreOffice दस्तावेज़ पुनर्निर्माण चाहिए। TXT सीधा निष्कर्षण है; soffice नहीं चाहिए।
फ़ॉन्ट और लेआउट बचते हैं?
TXT शुद्ध पाठ है। RTF सीमित पुनर्निर्माण है, पिक्सेल-स्तरीय मेल नहीं।

आख़िरी अपडेट:

कोड से कॉल करें

यहाँ हर उपकरण एक सादा REST एंडपॉइंट है। गुमनाम इस्तेमाल के लिए खाता या API कुंजी नहीं चाहिए। ब्राउज़र, डेवलपर और AI एजेंट, तीनों के लिए।

curl -X POST "https://pdf123.xyz/api/v1/convert/pdf/text" \
  -F "[email protected]" \
  -F "outputFormat=txt" \
  -o output.pdf

Model Context Protocol बोलने वाले एजेंट क्लाइंट के लिए MCP उपकरण भी है (JSON-RPC 2.0, POST /mcp)। पूरा API संदर्भ

AI एजेंट से इस्तेमाल करें

स्किल

इस स्किल से Claude Code, Codex, Cursor और दूसरे AI एजेंट आपके लिए “PDF से RTF (पाठ)” चला सकते हैं: /skills/pdf123-pdf-to-text.md

सभी एजेंट स्किल

फ़ाइलें केवल इस काम के लिए इस्तेमाल होती हैं, फिर अपने आप मिट जाती हैं।