استخرج الجداول من PDF إلى CSV
PDF إلى CSV يجد صفوف الجداول المحاذاة في نص PDF ويكتب كل جدول مكتشف ملف CSV؛ وتعود عدة جداول في ZIP. يحتاج طبقة نص ولا يعيد شيئًا للنثر أو المسوح الضوئية.
اسحب الملفات وأفلتها هنا، أو انقر للاختيار
يقبل PDF · حتى 500.0 MB لكل ملف · حتى 20 ملفات في المرة الواحدة
يمكنك أيضًا لصق ملف باستخدام Ctrl/Cmd+V أو من قائمة الحافظة.
PDF إلى CSV يشغّل `pdftotext -layout` ويبحث عن أسطر فيها مسافتان متتاليتان أو أكثر ويكتبها CSV. كل جدول مكتشف يصبح ملفًا `{base}_pN_tM.csv`. مناسب لـ PDF إلكتروني أعمدته محاذاة في النص المستخرج.
يحتاج الجدول صفين متتاليين على الأقل. النثر أو رأس وحيد أو مسح بلا طبقة نص يعطي `no_content`: HTTP 204 بلا ملف. النتيجة الفارغة مقصودة.
تتجاهل الأداة معاملات الطلب. حقل نطاق الصفحات في الصفحة لا يُقرأ؛ تُمسح كل الصفحات. جدول واحد `text/csv`؛ عدة جداول ZIP باسم `{base}_extracted.zip`. القطع عند مسافتين فأكثر؛ المسافة المفردة تبقى. الحقول تُقتبس وفق RFC 4180.
ليست OCR. المسوحات بلا محتوى لـ `pdftotext`. OCR يعيد Markdown لا يُرسل هنا. عندما توجد الكلمات في البكسلات فقط فهنا بلا ملف جدول.
PDF إلى Excel يستخدم الإرشاد نفسه ويضع الجداول أوراقًا في مصنف. CSV ملف لكل جدول. لا يستعيد أي منهما الدمج أو الأنماط من PDF.
افتح التنزيل في Excel أو Calc وراجع القطع. الجداول الضيقة بلا فجوات مسافتين غالبًا عمود واحد. الملفات المحمية بكلمة مرور تُفتح لك في هذه الصفحة بمجرد إدخال كلمة المرور؛ ومستخدمو API يجرون «إزالة كلمة المرور» أولًا.
الرفوعات مؤقتة. لا نحتفظ بمكتبة CSV لك.
الميزات
- `pdftotext -layout` مع إرشاد قطع بمسافتين
- CSV لكل جدول؛ عدة جداول ZIP؛ فراغ الكشف HTTP 204
- ليس OCR؛ Markdown من OCR لا يدخل هنا
- نقطة API مجهولة: /api/v1/convert/pdf/csv
حالات الاستخدام
- سحب جداول فواتير إلكترونية إلى Excel أو Calc
- جعل جداول الصفحات المتعددة ملفات CSV منفصلة
- مدخل لسكربتات تقبل CSV فقط
كيف أستخرج جدولًا من PDF إلى CSV؟
- ارفع PDF بنص قابل للتحديد وأعمدة جدولية.
- انقر معالجة. حقل النطاق موجود لكن المحوّل لا يقرؤه. بلا خيار OCR.
- جدول واحد ينزّل `.csv`؛ عدة جداول ZIP؛ بلا جداول نجاح فارغ.
- افتح في Excel أو Calc وتحقق من القطع.
الحدود والحالات الحدّية
- يحتاج نصًا قابلًا للتحديد وفجوات مسافتين
- بلا OCR؛ نطاق الصفحات بلا أثر
- لا يستعيد الدمج والأنماط
- حد الرفع في هذا الموقع: 500 ميغابايت لكل ملف، ويُرسل على أجزاء عندما يتجاوز نحو 95 ميغابايت. أما جسم طلب API المباشر الواحد فحده الأقصى 100 ميغابايت.
أمثلة
- PDF نصي بثلاثة أعمدة أسعار غالبًا يصبح CSV بتلك الأعمدة
- كشف حساب ممسوح بلا طبقة نص يعطي HTTP 204
خصوصية هذه الأداة
تُرفع الملفات عبر HTTPS، وتُعالَج في الذاكرة أو في مجلد مؤقت قصير العمر على خوادمنا، ثم تُحذف عندما يصبح الناتج جاهزًا. لا نحتفظ بنسخ للتصفح لاحقًا أو لتدريب النماذج أو لملفات الإعلانات. راجع سياسة الخصوصية لمدد الاحتفاظ وإفصاحات ملفات تعريف الارتباط الخاصة بـ AdSense.
أسئلة شائعة
- لماذا بلا CSV؟
- لم تُوجد صفوف جدول متتالية. المسوحات والنثر والجداول بلا فجوات مسافتين تفشل. النقطة تجيب 204 `no_content`.
- هل أستخدم OCR ثم CSV؟
- لا. OCR يعيد Markdown. هذه الأداة تقرأ عبر pdftotext فقط.
- ما الفرق عن PDF إلى Excel؟
- الكشف نفسه. CSV ملف لكل جدول (أو ZIP). Excel أوراق في مصنف واحد.
- هل تُقرأ كل الصفحات؟
- نعم. يقسّم pdftotext بفواصل الصفحات. حقل النطاق في الصفحة لا يُقرأ.
آخر تحديث:
الاستدعاء من الشيفرة
كل أداة هنا نقطة نهاية REST عادية. الاستخدام المجهول بلا حساب ولا مفتاح API. للمتصفح والمطوّرين والوكلاء على حد سواء.
curl -X POST "https://pdf123.xyz/api/v1/convert/pdf/csv" \
-F "[email protected]" \
-F "pageNumbers=all" \
-o output.pdfمتاحة أيضًا كأداة MCP لأي عميل وكيل يدعم Model Context Protocol (JSON-RPC 2.0 عبر POST /mcp). مرجع API الكامل
استخدمها من وكيل ذكاء اصطناعي
مهارةبهذه المهارة يستطيع Claude Code وCodex وCursor وغيرها من وكلاء الذكاء الاصطناعي تشغيل «PDF إلى CSV» نيابةً عنك: /skills/pdf123-pdf-to-csv.md
الملفات لهذه المعالجة فقط، وتُحذف تلقائيًا بعدها.