Product2026-08-233 मिनट पढ़ें

AI एजेंट के लिए बनाया गया, सिर्फ़ ब्राउज़र के लिए नहीं: API कैसे काम करता है

हर टूल /api/v1/ पर REST एंडपॉइंट है और /mcp पर MCP भी। अनाम कॉल को खाता या API की नहीं चाहिए। विफलताएँ RFC 7807 problem+json लौटाती हैं।

PDF123 · Updated 2026-09-20

ब्राउज़र टैब अब भी काम करता है: टूल चुनें, फ़ाइल अपलोड करें, नतीजा डाउनलोड करें। एजेंट और स्क्रिप्ट बिना इंटरफ़ेस वही प्रचालन कॉल करते हैं, और दोनों एक ही कैटलॉग पर पहुँचते हैं।

ब्राउज़र क्लिक और एजेंट या स्क्रिप्ट कॉल, दोनों एक ही API एंडपॉइंट से वही नतीजा पाते हैं, यह दिखाने वाला आरेख

हर टूल पेज एक एंडपॉइंट भी है

Merge, विभाजन, संपीड़न, OCR और रूपांतरण: कैटलॉग का हर टूल /api/v1/… पर मैप होता है। कोई टूल पेज खोलें और Call this from code तक स्क्रॉल करें: वहाँ उस टूल के असली पैरामीटर से बना curl उदाहरण मिलता है, कोई सामान्य टेम्पलेट नहीं। सार्वजनिक साइट पर अनाम कॉल के लिए न खाता चाहिए न API की; अनाम उपसर्ग हैं /api/v1/general/, /api/v1/misc/, /api/v1/security/, /api/v1/convert/ और /api/v1/filter/।

मर्ज का उदाहरण ठोस है:

curl -fsS -X POST "$API_BASE/api/v1/general/merge-pdfs" \
  -F "[email protected]" \
  -F "[email protected]" \
  -o merged.pdf

OpenAPI /v1/openapi.json पर है। बहु-चरणीय काम क्रमबद्ध steps सूची के साथ POST /api/v1/pipeline से होता है। जब किसी पुनः प्रयास से बदलाव करने वाला कार्य दोबारा न चलना हो, तो Idempotency-Key भेजें। होस्टेड प्रतिक्रियाएँ X-RateLimit-Limit, X-RateLimit-Remaining और X-RateLimit-Reset बताती हैं; HTTP 429 पर Retry-After पढ़ें (अनाम दर सीमा)।

उसी कैटलॉग से OCR, /api/v1/misc/ocr-pdf से Markdown (text/markdown) लौटाता है, छिपी टेक्स्ट परत वाली PDF नहीं। जो एजेंट इससे खोजने-योग्य PDF की अपेक्षा करते हैं, वे डाउनलोड गलत संभालेंगे; यहाँ अनुबंध पाइपलाइनों के लिए टेक्स्ट निष्कर्षण है, OCRmyPDF जैसा पुनर्लेखन नहीं।

जो क्लाइंट इस भाषा बोलते हैं, उनके लिए MCP

MCP (Model Context Protocol) एजेंट क्लाइंट को दस्तावेज़ स्क्रैप करने के बजाय टूल को फ़ंक्शन की तरह खोजने और चलाने देता है। यह साइट REST API के साथ /mcp पर MCP सर्वर देती है, ताकि संगत क्लाइंट एक बार जुड़कर पूरा कैटलॉग पा ले।

MCP और REST की प्रमाणीकरण अपेक्षाएँ साझा हैं: जहाँ टूल उपसर्ग अनुमति दें वहाँ अनाम; स्थिर स्वचालन और नियंत्रित स्वयं-होस्टेड सर्वर के लिए API की। /mcp की ओर एजेंट मोड़ना curl को /api/v1/… पर मोड़ने से अलग उत्पाद नहीं है। दस्तावेज़: Developers MCP।

त्रुटियाँ संरचित हैं, गद्य नहीं

विफलताएँ application/problem+json (RFC 7807 शैली) लौटाती हैं, न कि नंगा 500 या “कुछ गड़बड़ हो गई”। हर पेलोड में स्थिर कोड (rate_limited, bad_request, invalid_document, missing_dependency और समकक्ष), पढ़ने योग्य संकेत, और अक्सर अगला कदम होता है। मनुष्य इसे सरसरी नज़र से पढ़ सकते हैं; एजेंट बिना स्टैक ट्रेस पढ़े तय कर सकते हैं कि पुनः प्रयास करना है, फ़ाइल बदलनी है या रुकना है।

कॉलर स्क्रिप्ट हो तो यह संरचना मित्रतापूर्ण HTML त्रुटि पेज से ज़्यादा मायने रखती है। संदर्भ: Developers errors।

llms.txt टूलिंग के लिए है, रैंकिंग के लिए नहीं

/llms.txt हर टूल का सादा-पाठ सूचकांक है (नाम, संक्षिप्त विवरण, URL), जो उसी कैटलॉग से बनता है जो साइट चलाता है। कोडिंग एजेंट और दस्तावेज़-टूल इसे README की तरह पढ़ सकते हैं। यह Google रैंकिंग का लीवर नहीं है: Search /llms.txt को अनदेखा करता है (स्रोत: Google की AI अनुकूलन गाइड)। चूँकि यह जनित है, यह हाथ से संपादित फ़ाइल की तरह चुपचाप बासी नहीं पड़ती।

CLI और स्किल वही आकार साझा करते हैं

pdfx स्थानीय pdf-core चला सकता है, या --cloud के साथ किसी बेस URL पर। dist/skills/pdf-toolbox/SKILL.md के अंतर्गत कोडिंग-एजेंट स्किल, मर्ज और पाइपलाइन के curl आकार दर्ज करती है ताकि एजेंट दूसरा अनुबंध न गढ़ें। चार क्लाइंट, एक कैटलॉग: वही प्रचालन, चार क्लाइंट।

ब्राउज़र रास्ता जस का तस

टैब में फ़ाइल गिराना पहले जैसा ही काम करता है। अतिरिक्त सतह वही एंडपॉइंट हैं, एजेंट, स्क्रिप्ट या CI के लिए: वही प्रसंस्करण, बीच में कोई मनुष्य नहीं। स्वयं-होस्ट इस सतह को आपके नेटवर्क पर रखता है (Self-host); होस्टेड अनाम परीक्षण मार्ग बना रहता है।

API संदर्भ: Swagger। दोनों रास्तों की मूल बातें: सहायता और Developers।

Open tool
Process in the browser — no watermark, files removed after the job.
Open tool