حوّل جداول PDF إلى Excel
PDF إلى Excel يجد صفوف الجداول المحاذاة في نص PDF ويكتب كل جدول في ورقة مستقلة من مصنف .xlsx. يحتاج طبقة نص ولا يعيد شيئًا للنثر أو الصفحات الممسوحة.
اسحب الملفات وأفلتها هنا، أو انقر للاختيار
يقبل PDF · حتى 500.0 MB لكل ملف · حتى 20 ملفات في المرة الواحدة
يمكنك أيضًا لصق ملف باستخدام Ctrl/Cmd+V أو من قائمة الحافظة.
PDF إلى Excel يشغّل `pdftotext -layout` ويبحث عن أسطر فيها مسافتان متتاليتان أو أكثر ويكتب تلك الأسطر في مصنف `.xlsx`. كل جدول مكتشف يصبح ورقة باسم `Page N` أو `Page N Table M`. مناسب لـ PDF إلكتروني أعمدته محاذاة أصلًا في النص المستخرج.
يحتاج الجدول صفين متتاليين على الأقل يشبهان جدولًا. النثر أو صف رأس وحيد أو مسح بلا طبقة نص يعطي `no_content`: بلا مصنف. النتيجة الفارغة مقصودة لا فشل صامت.
تتجاهل الأداة معاملات الطلب. بلا حقل نطاق صفحات. تُقطع الأعمدة عند مسافتين متتاليتين أو أكثر؛ المسافة المفردة داخل الخلية تبقى.
ليست OCR. المسوحات الصورية بلا محتوى يقرؤه `pdftotext`. OCR في الموقع يعيد Markdown لا يُرسل إلى PDF إلى Excel. عندما توجد الكلمات في البكسلات فقط فهنا بلا جدول بيانات.
PDF إلى CSV يستخدم الإرشاد نفسه. جدول واحد يصبح CSV؛ عدة جداول ZIP من CSV. Excel يضع تلك الجداول أوراقًا في مصنف واحد. لا يستعيد أي منهما الخلايا المدمجة أو الرؤوس الملونة أو الأوراق المخفية من PDF.
افتح التنزيل في Excel أو LibreOffice Calc وراجع بضعة صفوف لقطع الأعمدة. الجداول الضيقة بلا فجوات مسافتين غالبًا تسقط في عمود واحد. الملفات المحمية بكلمة مرور تُفتح لك في هذه الصفحة بمجرد إدخال كلمة المرور؛ ومستخدمو API يجرون «إزالة كلمة المرور» أولًا.
الرفوعات مؤقتة. لا نحتفظ بمكتبة مصنفات لك.
الميزات
- `pdftotext -layout` مع إرشاد قطع الأعمدة بمسافتين
- ورقة لكل جدول مكتشف؛ بلا ملف عند فراغ الكشف
- ليس OCR؛ Markdown من OCR لا يدخل هنا
- نقطة API مجهولة: /api/v1/convert/pdf/xlsx
حالات الاستخدام
- فتح الجداول المستخرجة مباشرة في Excel أو Calc
- سحب جداول فواتير إلكترونية إلى مصنف
- جعل جداول الصفحات المتعددة أوراقًا لا CSV واحدًا
كيف أحوّل جدول PDF إلى Excel؟
- ارفع PDF بنص قابل للتحديد وأعمدة جدولية.
- انقر معالجة. بلا نطاق صفحات ولا خيار OCR.
- إن وُجدت جداول نزّل `.xlsx`. وإلا نجاح فارغ؛ غيّر المصدر بطبقة نص.
- افتح المصنف وتحقق من القطع. PDF نثري صرف لا ينتج أوراقًا.
الحدود والحالات الحدّية
- يحتاج نصًا قابلًا للتحديد وفجوات أعمدة بمسافتين
- بلا OCR ولا تحكم نطاق صفحات
- لا يستعيد الخلايا المدمجة والأنماط
- حد الرفع في هذا الموقع: 500 ميغابايت لكل ملف، ويُرسل على أجزاء عندما يتجاوز نحو 95 ميغابايت. أما جسم طلب API المباشر الواحد فحده الأقصى 100 ميغابايت.
أمثلة
- PDF نصي بقائمة أسعار من ثلاثة أعمدة غالبًا يصبح ورقة بتلك الأعمدة
- كشف حساب مصرفي ممسوح بلا طبقة نص لا يعيد مصنفًا
خصوصية هذه الأداة
تُرفع الملفات عبر HTTPS، وتُعالَج في الذاكرة أو في مجلد مؤقت قصير العمر على خوادمنا، ثم تُحذف عندما يصبح الناتج جاهزًا. لا نحتفظ بنسخ للتصفح لاحقًا أو لتدريب النماذج أو لملفات الإعلانات. راجع سياسة الخصوصية لمدد الاحتفاظ وإفصاحات ملفات تعريف الارتباط الخاصة بـ AdSense.
أسئلة شائعة
- لماذا بلا جدول بيانات؟
- لم تُوجد صفوف جدول متتالية. المسوحات والنثر والجداول بلا فجوات مسافتين تفشل هذا الإرشاد.
- هل أستخدم OCR ثم Excel؟
- لا. OCR يعيد Markdown. هذه الأداة تقرأ PDF عبر pdftotext فقط.
- ما الفرق عن PDF إلى CSV؟
- الكشف نفسه. Excel يكتب كل جدول ورقة في مصنف واحد. CSV ملف لكل جدول (واحد CSV أو ZIP لعدة).
- هل تُقرأ كل الصفحات؟
- نعم. يقسّم pdftotext بفواصل الصفحات ويمسح كتل الجداول في كل صفحة. بلا معامل نطاق.
آخر تحديث:
الاستدعاء من الشيفرة
كل أداة هنا نقطة نهاية REST عادية. الاستخدام المجهول بلا حساب ولا مفتاح API. للمتصفح والمطوّرين والوكلاء على حد سواء.
curl -X POST "https://pdf123.xyz/api/v1/convert/pdf/xlsx" \
-F "[email protected]" \
-o output.pdfمتاحة أيضًا كأداة MCP لأي عميل وكيل يدعم Model Context Protocol (JSON-RPC 2.0 عبر POST /mcp). مرجع API الكامل
استخدمها من وكيل ذكاء اصطناعي
مهارةبهذه المهارة يستطيع Claude Code وCodex وCursor وغيرها من وكلاء الذكاء الاصطناعي تشغيل «PDF إلى Excel» نيابةً عنك: /skills/pdf123-pdf-to-xlsx.md
الملفات لهذه المعالجة فقط، وتُحذف تلقائيًا بعدها.