حوّل PDF إلى HTML
PDF إلى HTML يحوّل ملف PDF عبر pdftohtml من Poppler ويسلّم ZIP يضم صفحات HTML وصورها. هو تفريغ للتخطيط لا شيفرة ويب نظيفة، ولا يجري OCR.
اسحب الملفات وأفلتها هنا، أو انقر للاختيار
يقبل PDF · حتى 500.0 MB لكل ملف · حتى 20 ملفات في المرة الواحدة
يمكنك أيضًا لصق ملف باستخدام Ctrl/Cmd+V أو من قائمة الحافظة.
PDF إلى HTML يشغّل Poppler `pdftohtml -c` ويضع ما يكتبه في مجلد الخرج داخل ZIP. اسم التنزيل `{base}ToHtml.zip` لا `.html` واحد. الهدف ليس CSS بمستوى المتصفح بل تصدير HTML وصور Poppler.
بلا حقول نموذج في هذه الصفحة. تُحوَّل كل الصفحات. إن لم يكتب `pdftohtml` شيئًا تعيد النقطة خطأً داخليًا لا ZIP فارغًا.
ليست OCR. المسوحات الصورية تصبح صورًا داخل الحزمة لا نصًا قابلًا للتحديد. الملفات المحمية بكلمة مرور تُفتح لك في هذه الصفحة بمجرد إدخال كلمة المرور؛ ومستخدمو API يجرون «إزالة كلمة المرور» أولًا.
للنص فقط استخدم PDF إلى نص. لمقال يناسب CMS استخدم PDF إلى Markdown.
الرفوعات مؤقتة. لا نحتفظ بمكتبة HTML لك.
الميزات
- Poppler `pdftohtml -c`؛ ZIP من HTML وموارد
- بلا نطاق صفحات ولا خيارات سمة
- ليس OCR؛ المسح يبقى صورة في الحزمة
- نقطة API مجهولة: /api/v1/convert/pdf/html
حالات الاستخدام
- الحصول على HTML خشن من PDF بطبقة نص
- أخذ صور الصفحات التي يستخرجها pdftohtml
- أرشفة سريعة بصيغة ويب تقريبية
كيف أحوّل PDF إلى HTML؟
- ارفع PDF. بلا خيارات تحويل في الصفحة.
- انقر معالجة ونزّل `{name}ToHtml.zip`.
- فك الضغط وافتح HTML في المتصفح.
- افحص الصور والنص. المسوحات لا تصبح نص HTML حقيقيًا.
الحدود والحالات الحدّية
- ليس محرك تخطيط متصفح
- بلا OCR
- المخرجات ZIP لا ملف HTML واحد
- حد الرفع في هذا الموقع: 500 ميغابايت لكل ملف، ويُرسل على أجزاء عندما يتجاوز نحو 95 ميغابايت. أما جسم طلب API المباشر الواحد فحده الأقصى 100 ميغابايت.
أمثلة
- مذكرة نصية غالبًا تعطي HTML وصورًا مساعدة في ZIP
- مسح صورة فقط يملأ الحزمة بصور الصفحات بلا نص مفيد
خصوصية هذه الأداة
تُرفع الملفات عبر HTTPS، وتُعالَج في الذاكرة أو في مجلد مؤقت قصير العمر على خوادمنا، ثم تُحذف عندما يصبح الناتج جاهزًا. لا نحتفظ بنسخ للتصفح لاحقًا أو لتدريب النماذج أو لملفات الإعلانات. راجع سياسة الخصوصية لمدد الاحتفاظ وإفصاحات ملفات تعريف الارتباط الخاصة بـ AdSense.
أسئلة شائعة
- لماذا الناتج ZIP؟
- يكتب pdftohtml HTML والصور المستخرجة في مجلد. الخادم يحزم ذلك المجلد.
- هل يطابق HTML تخطيط PDF؟
- بقدر وضع Poppler `-c`. المجلات متعددة الأعمدة والمتجهات الكثيرة غالبًا لا تتطابق.
- هل يحوّل المسح إلى نص HTML؟
- لا. المسار بلا OCR. للنص استخدم OCR إلى Markdown.
- هل التحويل في المتصفح؟
- لا. الخادم يستدعي pdftohtml.
آخر تحديث:
الاستدعاء من الشيفرة
كل أداة هنا نقطة نهاية REST عادية. الاستخدام المجهول بلا حساب ولا مفتاح API. للمتصفح والمطوّرين والوكلاء على حد سواء.
curl -X POST "https://pdf123.xyz/api/v1/convert/pdf/html" \
-F "[email protected]" \
-o output.pdfمتاحة أيضًا كأداة MCP لأي عميل وكيل يدعم Model Context Protocol (JSON-RPC 2.0 عبر POST /mcp). مرجع API الكامل
استخدمها من وكيل ذكاء اصطناعي
مهارةبهذه المهارة يستطيع Claude Code وCodex وCursor وغيرها من وكلاء الذكاء الاصطناعي تشغيل «PDF إلى HTML» نيابةً عنك: /skills/pdf123-pdf-to-html.md
الملفات لهذه المعالجة فقط، وتُحذف تلقائيًا بعدها.