Μετάβαση στο κύριο περιεχόμενο
PPDF123

Μετατροπή πινάκων PDF σε Excel

Το PDF σε Excel βρίσκει ευθυγραμμισμένες γραμμές πίνακα στο κείμενο ενός PDF και γράφει κάθε πίνακα σε δικό του φύλλο βιβλίου .xlsx. Χρειάζεται επίπεδο κειμένου και δεν δίνει τίποτα για συνεχές κείμενο ή σαρωμένες σελίδες.

Σύρετε και αφήστε αρχεία εδώ ή κάντε κλικ για επιλογή

Δέχεται PDF · έως 500.0 MB ανά αρχείο · έως 20 αρχεία τη φορά

Μπορείτε επίσης να επικολλήσετε ένα αρχείο με Ctrl/Cmd+V ή από το μενού του προχείρου.

PDF σε Excel τρέχει `pdftotext -layout`, ψάχνει γραμμές με δύο ή περισσότερα συνεχόμενα κενά και γράφει αυτές τις γραμμές σε βιβλίο `.xlsx`. Κάθε ανιχνευμένος πίνακας γίνεται φύλλο με όνομα `Page N` ή `Page N Table M`. Είναι για ηλεκτρονικά PDF όπου οι στήλες ήδη στοιχίζονται στο εξαγόμενο κείμενο.

Ένας πίνακας χρειάζεται τουλάχιστον δύο συνεχόμενες γραμμές που μοιάζουν με πίνακα. Πεζός λόγος, μία μόνο γραμμή επικεφαλίδας ή σάρωση χωρίς επίπεδο κειμένου δίνουν `no_content`: χωρίς βιβλίο. Το κενό αποτέλεσμα είναι σκόπιμο, όχι σιωπηλή αποτυχία.

Το εργαλείο αγνοεί παραμέτρους αιτήματος. Σε αυτή τη σελίδα δεν υπάρχει πεδίο εύρους σελίδων. Οι στήλες κόβονται σε δύο ή περισσότερα συνεχόμενα κενά· μεμονωμένα κενά μέσα στο κελί μένουν στο κελί.

Δεν είναι OCR. Αμιγώς εικονογραφημένες σαρώσεις δεν έχουν περιεχόμενο για `pdftotext`. Το OCR σε Markdown επιστρέφει Markdown που δεν ξαναστέλνεται σε PDF σε Excel. Όταν οι λέξεις υπάρχουν μόνο ως pixel, εδώ δεν βγαίνει υπολογιστικό φύλλο.

PDF σε CSV χρησιμοποιεί την ίδια ευρετική διάταξης. Ένας πίνακας γίνεται ένα CSV· πολλοί πίνακες γίνονται ZIP με CSV. Το Excel βάζει αυτούς τους πίνακες ως φύλλα στο ίδιο βιβλίο. Κανένα από τα δύο δεν ανασυνθέτει συγχωνευμένα κελιά, χρωματιστές επικεφαλίδες ή κρυφά φύλλα από το PDF.

Ανοίξτε τη λήψη στο Excel ή LibreOffice Calc και ελέγξτε μερικές γραμμές για το κόψιμο στηλών. Σφιχτοί πίνακες χωρίς διπλά κενά συχνά πέφτουν σε μία στήλη. Τα αρχεία με κωδικό ξεκλειδώνονται για εσάς σε αυτή τη σελίδα μόλις εισαγάγετε τον κωδικό· οι χρήστες API εκτελούν πρώτα «Αφαίρεση κωδικού».

Τα ανεβάσματα είναι προσωρινά. Δεν κρατάμε βιβλιοθήκη βιβλίων εργασίας.

Λειτουργίες

  • `pdftotext -layout` με ευρετική διαχωρισμού στηλών σε διπλά κενά
  • Ένα φύλλο ανά ανιχνευμένο πίνακα· κενή ανίχνευση = χωρίς αρχείο
  • Όχι OCR· το Markdown του OCR δεν έρχεται εδώ
  • Ανώνυμο API: /api/v1/convert/pdf/xlsx

Πότε το χρησιμοποιείτε

  • Άνοιγμα εξαγόμενων πινάκων απευθείας στο Excel ή LibreOffice Calc
  • Μεταφορά πίνακα ηλεκτρονικού τιμολογίου σε βιβλίο
  • Ένα φύλλο ανά πίνακα σε πολλές σελίδες αντί για ένα CSV

Πώς μετατρέπω έναν πίνακα PDF σε Excel;

  1. Ανεβάστε PDF με επιλέξιμο κείμενο και στηλοειδή διάταξη πίνακα.
  2. Πατήστε «Εκτέλεση». Δεν υπάρχουν επιλογές σελίδας ή OCR σε αυτό το εργαλείο.
  3. Αν βρεθούν πίνακες, κατεβάστε `.xlsx`. Αν όχι, παίρνετε κενή επιτυχία· αλλάξτε πηγή με επίπεδο κειμένου.
  4. Ανοίξτε το βιβλίο και ελέγξτε το κόψιμο. Αμιγώς πεζό PDF δεν παράγει φύλλα.

Όρια και ειδικές περιπτώσεις

  • Χρειάζεται επιλέξιμο κείμενο και διάκενα στηλών με διπλά κενά
  • Χωρίς OCR και χωρίς έλεγχο εύρους σελίδων
  • Δεν ανασυνθέτει συγχωνευμένα κελιά και στυλ
  • Όριο ανεβάσματος σε αυτόν τον ιστότοπο: 500 MB ανά αρχείο, με αποστολή σε τμήματα πάνω από περίπου 95 MB. Το σώμα ενός μεμονωμένου άμεσου αιτήματος API περιορίζεται στα 100 MB.

Παραδείγματα

  • Κειμενικό PDF με τρίστηλο τιμοκατάλογο συχνά γίνεται ένα φύλλο με αυτές τις στήλες
  • Σαρωμένη τραπεζική κατάσταση χωρίς επίπεδο κειμένου δεν επιστρέφει βιβλίο

Απόρρητο για αυτό το εργαλείο

Τα αρχεία ανεβαίνουν μέσω HTTPS, επεξεργάζονται στη μνήμη ή σε βραχύβιο προσωρινό κατάλογο στους διακομιστές μας και διαγράφονται όταν το αποτέλεσμα είναι έτοιμο. Δεν κρατάμε αντίγραφα για μετέπειτα περιήγηση, εκπαίδευση μοντέλων ή διαφημιστικά προφίλ. Οι λεπτομέρειες διατήρησης και οι γνωστοποιήσεις για cookie του AdSense βρίσκονται στην Πολιτική απορρήτου.

Συχνές ερωτήσεις

Γιατί δεν υπάρχει υπολογιστικό φύλλο;
Δεν βρέθηκαν δύο ή περισσότερες συνεχόμενες γραμμές πίνακα. Σαρώσεις, πεζός λόγος και πίνακες χωρίς διάκενα διπλού κενού αποτυγχάνουν σε αυτή την ευρετική.
Μπορώ πρώτα OCR και μετά Excel;
Όχι. Το OCR επιστρέφει Markdown. Αυτό το εργαλείο διαβάζει PDF μόνο μέσω pdftotext.
Τι διαφέρει από PDF σε CSV;
Η ανίχνευση είναι ίδια. Το Excel γράφει κάθε πίνακα σε χωριστό φύλλο του ίδιου βιβλίου. Το CSV βγάζει ένα αρχείο ανά πίνακα (ένα CSV ή ZIP με πολλά).
Διαβάζει κάθε σελίδα;
Ναι. Το pdftotext χωρίζει ανά αλλαγή σελίδας. Κάθε σελίδα σαρώνονται για μπλοκ πίνακα. Δεν υπάρχει παράμετρος εύρους σελίδων.

Τελευταία ενημέρωση:

Κλήση από κώδικα

Κάθε εργαλείο στον ιστότοπο είναι ένα απλό REST API. Για ανώνυμη χρήση δεν χρειάζεται λογαριασμός ούτε κλειδί API. Ίδιο για πρόγραμμα περιήγησης, προγραμματιστές και πράκτορες AI.

curl -X POST "https://pdf123.xyz/api/v1/convert/pdf/xlsx" \
  -F "[email protected]" \
  -o output.pdf

Διατίθεται και ως εργαλείο MCP, για πελάτες που μιλούν Model Context Protocol (JSON-RPC 2.0 μέσω POST /mcp). Πλήρης αναφορά API

Χρήση από πράκτορα AI

Skill

Με αυτό το skill, τα Claude Code, Codex, Cursor και άλλοι πράκτορες AI μπορούν να εκτελέσουν το «PDF σε Excel» για εσάς: /skills/pdf123-pdf-to-xlsx.md

Όλα τα skills για πράκτορες

Τα αρχεία χρησιμοποιούνται μόνο για αυτή την εργασία και διαγράφονται αυτόματα μετά.