Перетворення PDF на XML
PDF у XML імпортує PDF через LibreOffice і повертає XML-файл у стилі Office. Це експорт тексту й макета за можливістю, а не копія структури чи тегів PDF.
Перетягніть файли сюди або натисніть, щоб вибрати
Формати: PDF · до 500.0 MB на файл · до 20 файлів за раз
Файл також можна вставити через Ctrl/Cmd+V або з меню буфера обміну.
PDF у XML надсилає файл у LibreOffice `writer_pdf_import` з `outputFormat=xml`. Завантаження — XML у стилі Office (`octet-stream`), не відтворення потоків вмісту PDF чи структури tagged PDF.
Та сама родина імпорту, що й «PDF у Word», лише ціль — XML. Верстка, таблиці й шрифти — за можливості. Скани без текстового шару стають зображеннями або порожніми абзацами.
Опцій на сторінці немає. Файли, захищені паролем, на цій сторінці розблоковуються за вас, щойно ви введете пароль; виклики через API спочатку виконують «Зняти пароль». Markdown з OCR сюди не подається.
Для рядків таблиць — «PDF у CSV». Для самих слів — «PDF у RTF (текст)».
Вивантаження тимчасові. Бібліотеки XML ми не зберігаємо.
Що вміє
- LibreOffice `writer_pdf_import` → XML
- Не експорт структури PDF і не OCR
- Немає діапазону сторінок чи schema
- Анонімний API: /api/v1/convert/pdf/xml
Коли брати цей інструмент
- Отримати Office XML з PDF
- Паралельний шлях до Word-імпорту
- Чорновий XML для подальшої обробки
Як перетворити PDF на XML?
- Вивантажте PDF із текстом.
- Натисніть «Обробити».
- Завантажте XML.
- Не очікуйте tagged-PDF схеми.
Обмеження і межі
- Не структура PDF
- Не OCR
- Файли, захищені паролем, потребують пароля; виклики через API спочатку виконують «Зняти пароль»
- Обмеження завантаження на цьому сайті: 500 МБ на файл; якщо файл більший за приблизно 95 МБ, він надсилається частинами. Тіло одного прямого запиту до API — не більше 100 МБ.
Приклади
- Текстовий PDF → Office XML
- Скан → зображення/порожні абзаци
Приватність цього інструмента
Файли надсилаються через HTTPS, обробляються в оперативній пам’яті або в короткочасному тимчасовому каталозі на наших серверах і видаляються, щойно результат готовий. Копій для подальшого перегляду, навчання моделей чи рекламних профілів ми не зберігаємо. Строки зберігання та відомості про файли cookie AdSense наведені в Політиці конфіденційності.
Часті запитання
- Чи це структура PDF?
- Ні. Office-стиль XML після імпорту LibreOffice.
- Чи це OCR?
- Ні.
- Є опції?
- Ні.
- Потрібні таблиці?
- Краще «PDF у CSV».
Востаннє оновлено:
Виклик із коду
Кожен інструмент на сайті - звичайний REST-інтерфейс. Для анонімної роботи не потрібні обліковий запис чи ключ API. І для браузера, і для розробників, і для програмних агентів.
curl -X POST "https://pdf123.xyz/api/v1/convert/pdf/xml" \
-F "[email protected]" \
-o output.pdfТакож є як MCP-інструмент для клієнтів із Model Context Protocol (JSON-RPC 2.0 через POST /mcp). Повний довідник API
Використати через ШІ-агента
СкілЗ цим скілом Claude Code, Codex, Cursor та інші ШІ-агенти зможуть виконати «PDF у XML» замість вас: /skills/pdf123-pdf-to-xml.md
Файли потрібні лише для цієї обробки й потім стираються самі.