Μετάβαση στο κύριο περιεχόμενο
PPDF123

Μετατροπή πινάκων PDF σε Excel

Το PDF σε Excel βρίσκει ευθυγραμμισμένες γραμμές πίνακα στο κείμενο ενός PDF και γράφει κάθε πίνακα σε δικό του φύλλο βιβλίου .xlsx. Χρειάζεται επίπεδο κειμένου και δεν δίνει τίποτα για συνεχές κείμενο ή σαρωμένες σελίδες.

Σύρετε και αφήστε αρχεία εδώ ή κάντε κλικ για επιλογή

Δέχεται PDF · έως 500.0 MB ανά αρχείο · έως 20 αρχεία τη φορά

Μπορείτε επίσης να επικολλήσετε ένα αρχείο με Ctrl/Cmd+V ή από το μενού του προχείρου.

PDF σε Excel τρέχει `pdftotext -layout`, ψάχνει γραμμές με δύο ή περισσότερα συνεχόμενα κενά και γράφει αυτές τις γραμμές σε βιβλίο `.xlsx`. Κάθε ανιχνευμένος πίνακας γίνεται φύλλο με όνομα `Page N` ή `Page N Table M`. Είναι για ηλεκτρονικά PDF όπου οι στήλες ήδη στοιχίζονται στο εξαγόμενο κείμενο.

Ένας πίνακας χρειάζεται τουλάχιστον δύο συνεχόμενες γραμμές που μοιάζουν με πίνακα. Πεζός λόγος, μία μόνο γραμμή επικεφαλίδας ή σάρωση χωρίς επίπεδο κειμένου δίνουν `no_content`: χωρίς βιβλίο. Το κενό αποτέλεσμα είναι σκόπιμο, όχι σιωπηλή αποτυχία.

Το εργαλείο αγνοεί παραμέτρους αιτήματος. Σε αυτή τη σελίδα δεν υπάρχει πεδίο εύρους σελίδων. Οι στήλες κόβονται σε δύο ή περισσότερα συνεχόμενα κενά· μεμονωμένα κενά μέσα στο κελί μένουν στο κελί.

Δεν είναι OCR. Αμιγώς εικονογραφημένες σαρώσεις δεν έχουν περιεχόμενο για `pdftotext`. Το OCR σε αυτόν τον ιστότοπο επιστρέφει Markdown που δεν ξαναστέλνεται σε PDF σε Excel. Όταν οι λέξεις υπάρχουν μόνο ως pixel, εδώ δεν βγαίνει υπολογιστικό φύλλο.

PDF σε CSV χρησιμοποιεί την ίδια ευρετική διάταξης. Ένας πίνακας γίνεται ένα CSV· πολλοί πίνακες γίνονται ZIP με CSV. Το Excel βάζει αυτούς τους πίνακες ως φύλλα στο ίδιο βιβλίο. Κανένα από τα δύο δεν ανασυνθέτει συγχωνευμένα κελιά, χρωματιστές επικεφαλίδες ή κρυφά φύλλα από το PDF.

Ανοίξτε τη λήψη στο Excel ή LibreOffice Calc και ελέγξτε μερικές γραμμές για το κόψιμο στηλών. Σφιχτοί πίνακες χωρίς διπλά κενά συχνά πέφτουν σε μία στήλη. Τα αρχεία με κωδικό ξεκλειδώνονται για εσάς σε αυτή τη σελίδα μόλις εισαγάγετε τον κωδικό· οι χρήστες API εκτελούν πρώτα «Αφαίρεση κωδικού».

Ο κανόνας των δύο κενών είναι όλος ο μηχανισμός ανίχνευσης, οπότε η ποιότητα του βιβλίου εξαρτάται αποκλειστικά από το πώς στοιχειοθετήθηκε το PDF. Πίνακες από γεννήτριες αναφορών που γεμίζουν κάθε κελί σε σταθερό πλάτος εξάγονται καθαρά. Πίνακες με ένα μόνο κενό ανάμεσα στις στήλες ή με αναλογική γραμματοσειρά που φέρνει τις στήλες σχεδόν δίπλα-δίπλα δεν καταγράφονται καθόλου ως πίνακες και μπορεί να μη δώσουν βιβλίο. Πριν κατηγορήσετε το εργαλείο, επιλέξτε μια γραμμή του PDF και επιβεβαιώστε ότι το κείμενο είναι έστω επιλέξιμο.

Η ονομασία των φύλλων ακολουθεί τη θέση, όχι το περιεχόμενο. Κάθε ανιχνευμένο μπλοκ γίνεται `Page N` ή `Page N Table M`, με τη σειρά που σαρώνονται οι σελίδες. Μια αναφορά με έναν πίνακα ανά σελίδα δίνει ένα φύλλο ανά σελίδα· μια σελίδα με τρεις στοιβαγμένους πίνακες δίνει τρία αριθμημένα φύλλα. Δεν υπάρχει επιλογή ονομασίας φύλλων από κελί επικεφαλίδας, ούτε συνδυασμένη έξοδος σε ένα φύλλο.

Οι τιμές γράφονται ως κείμενο, ακριβώς όπως εμφανίστηκαν στην εξαγωγή που διατηρεί τη διάταξη. Οι αριθμοί δεν μετατρέπονται σε αριθμητικά κελιά, οπότε τα μηδενικά στην αρχή επιβιώνουν και τα σύμβολα νομίσματος και τα διαχωριστικά χιλιάδων μένουν στη συμβολοσειρά. Αυτό συνήθως το θέλετε για αριθμούς λογαριασμών και ταχυδρομικούς κώδικες, αλλά είναι λίγο ενοχλητικό για μια στήλη ποσών που σκοπεύετε να αθροίσετε. Είτε μετατρέψτε τους τύπους στο υπολογιστικό φύλλο, είτε αντιγράψτε τη στήλη και χρησιμοποιήστε «κείμενο σε στήλες» ή μετατροπή τιμών στο πρόγραμμα προορισμού.

Οι γραμμές δεν αποδιπλοποιούνται και οι επαναλαμβανόμενες επικεφαλίδες δεν αφαιρούνται. Όταν ένας πίνακας σπάει στο όριο σελίδας, η γραμμή επικεφαλίδας συχνά επαναλαμβάνεται στην επόμενη σελίδα και η συνέχεια γίνεται δικό της φύλλο. Τα συγχωνευμένα κελιά δεν ανακατασκευάζονται· ένα κελί που εκτεινόταν σε δύο στήλες στο PDF έχει απλώς το κείμενό του στην αριστερότερη στήλη και η δεξιά μένει κενή. Τα πολυγραμμικά κελιά γίνονται ξεχωριστές γραμμές αντί για μία τιμή με αναδίπλωση.

Τα ανεβάσματα είναι προσωρινά. Δεν κρατάμε βιβλιοθήκη βιβλίων εργασίας.

Λειτουργίες

  • `pdftotext -layout` με ευρετική διαχωρισμού στηλών σε διπλά κενά
  • Ένα φύλλο ανά ανιχνευμένο πίνακα· κενή ανίχνευση = χωρίς αρχείο
  • Όχι OCR· το Markdown του OCR δεν έρχεται εδώ
  • Κελιά τύπου κειμένου· χωρίς συμπερασμό τύπων ή ανακατασκευή συγχωνευμένων κελιών
  • Ανώνυμο API: /api/v1/convert/pdf/xlsx

Πότε το χρησιμοποιείτε

  • Άνοιγμα εξαγόμενων πινάκων απευθείας στο Excel ή LibreOffice Calc
  • Μεταφορά πίνακα ηλεκτρονικού τιμολογίου σε βιβλίο
  • Ένα φύλλο ανά πίνακα σε πολλές σελίδες αντί για ένα CSV
  • Εξαγωγή οικονομικής κατάστασης σταθερής διάταξης για περαιτέρω ανάλυση

Πώς μετατρέπω έναν πίνακα PDF σε Excel;

  1. Ανεβάστε PDF με επιλέξιμο κείμενο και στηλοειδή διάταξη πίνακα.
  2. Πατήστε «Εκτέλεση». Δεν υπάρχουν επιλογές σελίδας ή OCR σε αυτό το εργαλείο.
  3. Αν βρεθούν πίνακες, κατεβάστε `.xlsx`. Αν όχι, παίρνετε κενή επιτυχία· δοκιμάστε πηγή με επίπεδο κειμένου.
  4. Ανοίξτε το βιβλίο και ελέγξτε το κόψιμο. Αμιγώς πεζό PDF δεν παράγει φύλλα.

Όρια και ειδικές περιπτώσεις

  • Χρειάζεται επιλέξιμο κείμενο και διάκενο στηλών με διπλά κενά
  • Χωρίς OCR και χωρίς έλεγχο εύρους σελίδων
  • Τα συγχωνευμένα κελιά και το στυλ δεν ανακατασκευάζονται
  • Όλες οι τιμές είναι κείμενο· χωρίς τύπους αριθμού ή ημερομηνίας
  • Οι πίνακες που εκτείνονται σε σελίδες γίνονται ξεχωριστά φύλλα
  • Όριο ανεβάσματος σε αυτόν τον ιστότοπο: 500 MB ανά αρχείο, με αποστολή σε τμήματα πάνω από περίπου 95 MB. Το σώμα ενός μεμονωμένου άμεσου αιτήματος API περιορίζεται στα 100 MB.

Παραδείγματα

  • Κειμενικό PDF με τρίστηλο τιμοκατάλογο συχνά γίνεται ένα φύλλο με αυτές τις στήλες
  • Σαρωμένη τραπεζική κατάσταση χωρίς επίπεδο κειμένου δεν επιστρέφει βιβλίο
  • Μια δεκασέλιδη αναφορά με έναν πίνακα ανά σελίδα δίνει δέκα φύλλα από Page 1 έως Page 10

Απόρρητο για αυτό το εργαλείο

Τα αρχεία ανεβαίνουν μέσω HTTPS, επεξεργάζονται στη μνήμη ή σε βραχύβιο προσωρινό κατάλογο στους διακομιστές μας και διαγράφονται όταν το αποτέλεσμα είναι έτοιμο. Δεν κρατάμε αντίγραφα για μετέπειτα περιήγηση, εκπαίδευση μοντέλων ή διαφημιστικά προφίλ. Οι λεπτομέρειες διατήρησης και οι γνωστοποιήσεις για cookie του AdSense βρίσκονται στην Πολιτική απορρήτου.

Συχνές ερωτήσεις

Γιατί δεν πήρα υπολογιστικό φύλλο;
Δεν βρέθηκε μπλοκ από δύο ή περισσότερες συνεχόμενες γραμμές πίνακα. Σαρώσεις, πεζός λόγος και πίνακες χωρίς διάκενο διπλού κενού αποτυγχάνουν σε αυτή την ευρετική.
Μπορώ πρώτα OCR και μετά Excel;
Όχι. Το OCR επιστρέφει Markdown. Αυτό το εργαλείο διαβάζει PDF μόνο μέσω pdftotext.
Τι διαφέρει από PDF σε CSV;
Η ανίχνευση είναι ίδια. Το Excel γράφει κάθε πίνακα σε δικό του φύλλο του ίδιου βιβλίου. Το CSV βγάζει ένα αρχείο ανά πίνακα (ένα CSV ή ZIP με πολλά).
Διαβάζει κάθε σελίδα;
Ναι. Το pdftotext χωρίζει ανά αλλαγή σελίδας. Κάθε σελίδα σαρώνεται για μπλοκ πίνακα. Δεν υπάρχει παράμετρος εύρους σελίδων.
Γιατί οι αριθμοί μου αποθηκεύονται ως κείμενο;
Οι τιμές γράφονται ακριβώς όπως εξήχθησαν, ώστε να διατηρούνται τα μηδενικά στην αρχή και η μορφοποίηση. Μετατρέψτε τη στήλη σε αριθμητική στο υπολογιστικό φύλλο αν θέλετε να υπολογίζετε με αυτήν.
Ανακατασκευάζονται τα συγχωνευμένα κελιά;
Όχι. Το κείμενο ενός συγχωνευμένου κελιού πηγαίνει στην αριστερότερη στήλη και οι άλλες μένουν κενές. Τα πολυγραμμικά κελιά γίνονται ξεχωριστές γραμμές αντί για μία τιμή με αναδίπλωση.
Γιατί έχω πολλά φύλλα για έναν πίνακα;
Ένας πίνακας που συνεχίζεται σε νέα σελίδα ανιχνεύεται ξανά εκεί και γίνεται άλλο φύλλο. Οι γραμμές επικεφαλίδας συχνά επαναλαμβάνονται· το εργαλείο δεν ενώνει τα τμήματα.

Τελευταία ενημέρωση:

Κλήση από κώδικα

Κάθε εργαλείο στον ιστότοπο είναι ένα απλό REST API. Για ανώνυμη χρήση δεν χρειάζεται λογαριασμός ούτε κλειδί API. Ίδιο για πρόγραμμα περιήγησης, προγραμματιστές και πράκτορες AI.

curl -X POST "https://pdf123.xyz/api/v1/convert/pdf/xlsx" \
  -F "[email protected]" \
  -o output.pdf

Διατίθεται και ως εργαλείο MCP, για πελάτες που μιλούν Model Context Protocol (JSON-RPC 2.0 μέσω POST /mcp). Πλήρης αναφορά API

Χρήση από πράκτορα AI

Skill

Με αυτό το skill, τα Claude Code, Codex, Cursor και άλλοι πράκτορες AI μπορούν να εκτελέσουν το «PDF σε Excel» για εσάς: /skills/pdf123-pdf-to-xlsx.md

Όλα τα skills για πράκτορες

Τα αρχεία χρησιμοποιούνται μόνο για αυτή την εργασία και διαγράφονται αυτόματα μετά.