Μετατροπή PDF σε HTML
Το PDF σε HTML μετατρέπει ένα PDF με το pdftohtml του Poppler και παραδίδει ZIP με τις σελίδες HTML και τις εικόνες τους. Είναι εξαγωγή διάταξης και όχι καθαρός κώδικας web, και δεν κάνει OCR.
Σύρετε και αφήστε αρχεία εδώ ή κάντε κλικ για επιλογή
Δέχεται PDF · έως 500.0 MB ανά αρχείο · έως 20 αρχεία τη φορά
Μπορείτε επίσης να επικολλήσετε ένα αρχείο με Ctrl/Cmd+V ή από το μενού του προχείρου.
PDF σε HTML τρέχει Poppler `pdftohtml -c` και συσκευάζει σε ZIP ό,τι γράφει το εργαλείο στον κατάλογο εξόδου. Το όνομα λήψης είναι `{base}ToHtml.zip`, όχι μεμονωμένο `.html`. Στόχος δεν είναι CSS επιπέδου προγράμματος περιήγησης, αλλά εξαγωγή HTML και εικόνων του Poppler.
Σε αυτή τη σελίδα δεν υπάρχουν πεδία φόρμας. Μετατρέπεται κάθε σελίδα. Αν το `pdftohtml` δεν γράψει τίποτα, το API επιστρέφει εσωτερικό σφάλμα, όχι κενό ZIP.
Δεν είναι OCR. Αμιγώς εικονογραφημένες σαρώσεις γίνονται εικόνες μέσα στο πακέτο HTML, όχι επιλέξιμο κείμενο. Τα αρχεία με κωδικό ξεκλειδώνονται για εσάς σε αυτή τη σελίδα μόλις εισαγάγετε τον κωδικό· οι χρήστες API εκτελούν πρώτα «Αφαίρεση κωδικού».
Αν θέλετε μόνο κείμενο, χρησιμοποιήστε PDF σε RTF (κείμενο). Αν θέλετε άρθρο κατάλληλο για CMS, χρησιμοποιήστε PDF σε Markdown.
Τα ανεβάσματα είναι προσωρινά. Δεν κρατάμε βιβλιοθήκη HTML.
Λειτουργίες
- Poppler `pdftohtml -c`, έξοδος ZIP με HTML και πόρους
- Χωρίς εύρος σελίδων ή επιλογές θέματος
- Όχι OCR· οι σαρώσεις μένουν εικόνες στο πακέτο
- Ανώνυμο API: /api/v1/convert/pdf/html
Πότε το χρησιμοποιείτε
- Χονδροειδές HTML από PDF με επίπεδο κειμένου
- Λήψη εικόνων σελίδας που εξάγει το pdftohtml
- Προεπισκόπηση του πώς καταλαβαίνει το Poppler το αρχείο πριν από ιδιωτική ροή
Πώς μετατρέπω ένα PDF σε HTML;
- Ανεβάστε PDF. Δεν υπάρχουν επιλογές μετατροπής σε αυτή τη σελίδα.
- Πατήστε «Εκτέλεση» και κατεβάστε `{name}ToHtml.zip`.
- Αποσυμπιέστε και ανοίξτε το HTML στο πρόγραμμα περιήγησης.
- Ελέγξτε εικόνες και κείμενο. Οι σαρώσεις δεν γίνονται πραγματικό κείμενο HTML.
Όρια και ειδικές περιπτώσεις
- Η έξοδος είναι ZIP, όχι μεμονωμένο HTML
- Όχι εκτύπωση Chromium ούτε εξαγωγή HTML από tagged PDF
- Κενή έξοδος pdftohtml είναι σφάλμα, όχι 204
- Όριο ανεβάσματος σε αυτόν τον ιστότοπο: 500 MB ανά αρχείο, με αποστολή σε τμήματα πάνω από περίπου 95 MB. Το σώμα ενός μεμονωμένου άμεσου αιτήματος API περιορίζεται στα 100 MB.
Παραδείγματα
- Απλό κειμενικό υπόμνημα συχνά αποσυμπιέζεται σε ένα HTML και λίγες εικόνες
- Καθαρά σαρωμένο PDF δίνει HTML που κυρίως συσκευάζει εικόνες σελίδων
Απόρρητο για αυτό το εργαλείο
Τα αρχεία ανεβαίνουν μέσω HTTPS, επεξεργάζονται στη μνήμη ή σε βραχύβιο προσωρινό κατάλογο στους διακομιστές μας και διαγράφονται όταν το αποτέλεσμα είναι έτοιμο. Δεν κρατάμε αντίγραφα για μετέπειτα περιήγηση, εκπαίδευση μοντέλων ή διαφημιστικά προφίλ. Οι λεπτομέρειες διατήρησης και οι γνωστοποιήσεις για cookie του AdSense βρίσκονται στην Πολιτική απορρήτου.
Συχνές ερωτήσεις
- Γιατί το αποτέλεσμα είναι ZIP;
- Το pdftohtml γράφει HTML και εξαγόμενες εικόνες σε φάκελο. Ο διακομιστής συσκευάζει εκείνον τον φάκελο.
- Το HTML θα ταιριάζει με τη διάταξη PDF;
- Μόνο όσο επιτρέπει η λειτουργία Poppler `-c`. Πολυστήλες περιοδικά και βαριά διανύσματα συχνά δεν στοιχίζονται.
- Μπορεί σάρωση να γίνει κείμενο HTML;
- Όχι. Αυτή η διαδρομή δεν κάνει OCR. Για κείμενο χρησιμοποιήστε OCR σε Markdown.
- Γίνεται η μετατροπή στο πρόγραμμα περιήγησης;
- Όχι. Ο διακομιστής καλεί pdftohtml.
Τελευταία ενημέρωση:
Κλήση από κώδικα
Κάθε εργαλείο στον ιστότοπο είναι ένα απλό REST API. Για ανώνυμη χρήση δεν χρειάζεται λογαριασμός ούτε κλειδί API. Ίδιο για πρόγραμμα περιήγησης, προγραμματιστές και πράκτορες AI.
curl -X POST "https://pdf123.xyz/api/v1/convert/pdf/html" \
-F "[email protected]" \
-o output.pdfΔιατίθεται και ως εργαλείο MCP, για πελάτες που μιλούν Model Context Protocol (JSON-RPC 2.0 μέσω POST /mcp). Πλήρης αναφορά API
Χρήση από πράκτορα AI
SkillΜε αυτό το skill, τα Claude Code, Codex, Cursor και άλλοι πράκτορες AI μπορούν να εκτελέσουν το «PDF σε HTML» για εσάς: /skills/pdf123-pdf-to-html.md
Τα αρχεία χρησιμοποιούνται μόνο για αυτή την εργασία και διαγράφονται αυτόματα μετά.