Przejdź do głównej treści
PPDF123

Konwersja PDF na XML

PDF na XML importuje PDF przez LibreOffice i zwraca plik XML w stylu Office. To eksport tekstu i układu w miarę możliwości, a nie kopia struktury ani znaczników PDF.

Przeciągnij pliki tutaj albo kliknij, żeby wybrać

Obsługiwane: PDF · do 500.0 MB na plik · maks. 20 plików naraz

Możesz też wkleić plik przez Ctrl/Cmd+V lub z menu schowka.

Konwersja PDF na XML puszcza plik przez LibreOffice `writer_pdf_import` z `outputFormat=xml`. Pobranie to XML w stylu Office (`octet-stream`), nie odtworzenie strumieni treści PDF ani struktury tagged-PDF.

To ta sama rodzina importu LibreOffice co PDF na Word, tylko cel to XML. Układ, tabele i czcionki są robione na tyle, na ile się da. Skany bez warstwy tekstu stają się obrazami lub pustymi akapitami.

Na tej stronie nie ma opcji. Pliki chronione hasłem są odblokowywane za Ciebie na tej stronie, gdy tylko wpiszesz hasło; wywołujący API najpierw uruchamiają Usuń hasło. Markdown z OCR nie wchodzi tutaj.

Do wierszy z tabel — PDF na CSV. Do samego tekstu — PDF na RTF (tekst).

Przesłania są tymczasowe. Nie prowadzimy biblioteki Twojego XML.

Funkcje

  • LibreOffice `writer_pdf_import` do XML
  • Nie eksport struktury PDF i nie OCR
  • Bez zakresu stron ani opcji schematu
  • Anonimowe API: /api/v1/convert/pdf/xml

Kiedy tego użyć

  • Przekazać elektroniczny PDF łańcuchowi przyjmującemu Office XML
  • Zobaczyć, jak LibreOffice tnie dokument
  • Wziąć szkic XML, gdy następny krok nie jest DOCX

Jak zamienić PDF na XML?

  1. Prześlij PDF z tekstem.
  2. Kliknij Przetwórz. Na tej stronie nie ma opcji formatu.
  3. Pobierz `.xml`.
  4. Otwórz w LibreOffice lub edytorze i traktuj jako szkic.

Ograniczenia i przypadki brzegowe

  • To nie tagged-PDF ani wyciąganie XFDF/XFA
  • Nie OCR
  • Tabele i paginacja nie pokryją się z PDF
  • Limit przesyłania na tej stronie: 500 MB na plik, wysyłane porcjami powyżej około 95 MB. Treść pojedynczego bezpośredniego żądania API jest ograniczona do 100 MB.

Przykłady

  • Notatka tekstowa często staje się dużym Office XML z przebiegami akapitów
  • Czysty skan PDF często staje się XML głównie opakowującym obrazy

Prywatność tego narzędzia

Pliki są przesyłane przez HTTPS, przetwarzane w pamięci lub w krótkotrwałym katalogu tymczasowym na naszych serwerach i usuwane, gdy wynik jest gotowy. Nie przechowujemy kopii do późniejszego przeglądania, trenowania ani profili reklamowych. Szczegóły retencji i pliki cookie AdSense znajdują się w polityce prywatności.

Najczęstsze pytania

Czy to wewnętrzny XML PDF?
Nie. To eksport zaimportowanego dokumentu przez LibreOffice do XML, nie drzewo obiektów PDF.
Dlaczego skan jest niemal pusty?
LibreOffice nie ma tekstu do importu. Tekst w pikselach — OCR do Markdown.
Czy mogę wybrać inny dialekt XML?
Nie. Ta ścieżka ustawia outputFormat na sztywno na xml i tylko tę wartość akceptuje.
Czym różni się od PDF na Word?
Importer ten sam, wynik inny. PDF na Word daje docx, doc lub odt. Ta ścieżka daje xml.

Ostatnia aktualizacja:

Wywołanie z kodu

Każde narzędzie na stronie to zwykły interfejs REST. Anonimowo nie trzeba konta ani klucza API. Działa w przeglądarce, u programistów i u agentów AI.

curl -X POST "https://pdf123.xyz/api/v1/convert/pdf/xml" \
  -F "[email protected]" \
  -o output.pdf

Dostępne też jako narzędzie MCP dla klientów mówiących Model Context Protocol (JSON-RPC 2.0, POST /mcp). Pełna dokumentacja API

Użyj go z agentem AI

Skill

Z tym skillem Claude Code, Codex, Cursor i inne agenty AI mogą wykonać za Ciebie „PDF na XML”: /skills/pdf123-pdf-to-xml.md

Wszystkie skille dla agentów

Pliki służą tylko do tego zadania i są potem automatycznie usuwane.