Перейти до основного вмісту
PPDF123

Перетворення PDF на XML

PDF у XML імпортує PDF через LibreOffice і повертає XML-файл у стилі Office. Це експорт тексту й макета за можливістю, а не копія структури чи тегів PDF.

Перетягніть файли сюди або натисніть, щоб вибрати

Формати: PDF · до 500.0 MB на файл · до 20 файлів за раз

Файл також можна вставити через Ctrl/Cmd+V або з меню буфера обміну.

PDF у XML надсилає файл у LibreOffice `writer_pdf_import` з `outputFormat=xml`. Завантаження — XML у стилі Office (`octet-stream`), не відтворення потоків вмісту PDF чи структури tagged PDF.

Та сама родина імпорту, що й «PDF у Word», лише ціль — XML. Верстка, таблиці й шрифти — за можливості. Скани без текстового шару стають зображеннями або порожніми абзацами.

Опцій на сторінці немає. Файли, захищені паролем, на цій сторінці розблоковуються за вас, щойно ви введете пароль; виклики через API спочатку виконують «Зняти пароль». Markdown з OCR сюди не подається.

Для рядків таблиць — «PDF у CSV». Для самих слів — «PDF у RTF (текст)».

Вивантаження тимчасові. Бібліотеки XML ми не зберігаємо.

Що вміє

  • LibreOffice `writer_pdf_import` → XML
  • Не експорт структури PDF і не OCR
  • Немає діапазону сторінок чи schema
  • Анонімний API: /api/v1/convert/pdf/xml

Коли брати цей інструмент

  • Отримати Office XML з PDF
  • Паралельний шлях до Word-імпорту
  • Чорновий XML для подальшої обробки

Як перетворити PDF на XML?

  1. Вивантажте PDF із текстом.
  2. Натисніть «Обробити».
  3. Завантажте XML.
  4. Не очікуйте tagged-PDF схеми.

Обмеження і межі

  • Не структура PDF
  • Не OCR
  • Файли, захищені паролем, потребують пароля; виклики через API спочатку виконують «Зняти пароль»
  • Обмеження завантаження на цьому сайті: 500 МБ на файл; якщо файл більший за приблизно 95 МБ, він надсилається частинами. Тіло одного прямого запиту до API — не більше 100 МБ.

Приклади

  • Текстовий PDF → Office XML
  • Скан → зображення/порожні абзаци

Приватність цього інструмента

Файли надсилаються через HTTPS, обробляються в оперативній пам’яті або в короткочасному тимчасовому каталозі на наших серверах і видаляються, щойно результат готовий. Копій для подальшого перегляду, навчання моделей чи рекламних профілів ми не зберігаємо. Строки зберігання та відомості про файли cookie AdSense наведені в Політиці конфіденційності.

Часті запитання

Чи це структура PDF?
Ні. Office-стиль XML після імпорту LibreOffice.
Чи це OCR?
Ні.
Є опції?
Ні.
Потрібні таблиці?
Краще «PDF у CSV».

Востаннє оновлено:

Виклик із коду

Кожен інструмент на сайті - звичайний REST-інтерфейс. Для анонімної роботи не потрібні обліковий запис чи ключ API. І для браузера, і для розробників, і для програмних агентів.

curl -X POST "https://pdf123.xyz/api/v1/convert/pdf/xml" \
  -F "[email protected]" \
  -o output.pdf

Також є як MCP-інструмент для клієнтів із Model Context Protocol (JSON-RPC 2.0 через POST /mcp). Повний довідник API

Використати через ШІ-агента

Скіл

З цим скілом Claude Code, Codex, Cursor та інші ШІ-агенти зможуть виконати «PDF у XML» замість вас: /skills/pdf123-pdf-to-xml.md

Усі скіли для агентів

Файли потрібні лише для цієї обробки й потім стираються самі.