Konwersja PDF na XML
PDF na XML importuje PDF przez LibreOffice i zwraca plik XML w stylu Office. To eksport tekstu i układu w miarę możliwości, a nie kopia struktury ani znaczników PDF.
Przeciągnij pliki tutaj albo kliknij, żeby wybrać
Obsługiwane: PDF · do 500.0 MB na plik · maks. 20 plików naraz
Możesz też wkleić plik przez Ctrl/Cmd+V lub z menu schowka.
Konwersja PDF na XML puszcza plik przez LibreOffice `writer_pdf_import` z `outputFormat=xml`. Pobranie to XML w stylu Office (`octet-stream`), nie odtworzenie strumieni treści PDF ani struktury tagged-PDF.
To ta sama rodzina importu LibreOffice co PDF na Word, tylko cel to XML. Układ, tabele i czcionki są robione na tyle, na ile się da. Skany bez warstwy tekstu stają się obrazami lub pustymi akapitami.
Na tej stronie nie ma opcji. Pliki chronione hasłem są odblokowywane za Ciebie na tej stronie, gdy tylko wpiszesz hasło; wywołujący API najpierw uruchamiają Usuń hasło. Markdown z OCR nie wchodzi tutaj.
Do wierszy z tabel — PDF na CSV. Do samego tekstu — PDF na RTF (tekst).
Przesłania są tymczasowe. Nie prowadzimy biblioteki Twojego XML.
Funkcje
- LibreOffice `writer_pdf_import` do XML
- Nie eksport struktury PDF i nie OCR
- Bez zakresu stron ani opcji schematu
- Anonimowe API: /api/v1/convert/pdf/xml
Kiedy tego użyć
- Przekazać elektroniczny PDF łańcuchowi przyjmującemu Office XML
- Zobaczyć, jak LibreOffice tnie dokument
- Wziąć szkic XML, gdy następny krok nie jest DOCX
Jak zamienić PDF na XML?
- Prześlij PDF z tekstem.
- Kliknij Przetwórz. Na tej stronie nie ma opcji formatu.
- Pobierz `.xml`.
- Otwórz w LibreOffice lub edytorze i traktuj jako szkic.
Ograniczenia i przypadki brzegowe
- To nie tagged-PDF ani wyciąganie XFDF/XFA
- Nie OCR
- Tabele i paginacja nie pokryją się z PDF
- Limit przesyłania na tej stronie: 500 MB na plik, wysyłane porcjami powyżej około 95 MB. Treść pojedynczego bezpośredniego żądania API jest ograniczona do 100 MB.
Przykłady
- Notatka tekstowa często staje się dużym Office XML z przebiegami akapitów
- Czysty skan PDF często staje się XML głównie opakowującym obrazy
Prywatność tego narzędzia
Pliki są przesyłane przez HTTPS, przetwarzane w pamięci lub w krótkotrwałym katalogu tymczasowym na naszych serwerach i usuwane, gdy wynik jest gotowy. Nie przechowujemy kopii do późniejszego przeglądania, trenowania ani profili reklamowych. Szczegóły retencji i pliki cookie AdSense znajdują się w polityce prywatności.
Najczęstsze pytania
- Czy to wewnętrzny XML PDF?
- Nie. To eksport zaimportowanego dokumentu przez LibreOffice do XML, nie drzewo obiektów PDF.
- Dlaczego skan jest niemal pusty?
- LibreOffice nie ma tekstu do importu. Tekst w pikselach — OCR do Markdown.
- Czy mogę wybrać inny dialekt XML?
- Nie. Ta ścieżka ustawia outputFormat na sztywno na xml i tylko tę wartość akceptuje.
- Czym różni się od PDF na Word?
- Importer ten sam, wynik inny. PDF na Word daje docx, doc lub odt. Ta ścieżka daje xml.
Ostatnia aktualizacja:
Wywołanie z kodu
Każde narzędzie na stronie to zwykły interfejs REST. Anonimowo nie trzeba konta ani klucza API. Działa w przeglądarce, u programistów i u agentów AI.
curl -X POST "https://pdf123.xyz/api/v1/convert/pdf/xml" \
-F "[email protected]" \
-o output.pdfDostępne też jako narzędzie MCP dla klientów mówiących Model Context Protocol (JSON-RPC 2.0, POST /mcp). Pełna dokumentacja API
Użyj go z agentem AI
SkillZ tym skillem Claude Code, Codex, Cursor i inne agenty AI mogą wykonać za Ciebie „PDF na XML”: /skills/pdf123-pdf-to-xml.md
Pliki służą tylko do tego zadania i są potem automatycznie usuwane.