Перейти до основного вмісту
PPDF123

Перетворення PDF на текст

PDF у RTF (текст) витягує текст, що вже є в PDF, і повертає його звичайним файлом .txt або як RTF. OCR він не виконує, тож скани лише із зображень виходять порожніми.

Перетягніть файли сюди або натисніть, щоб вибрати

Формати: PDF · до 500.0 MB на файл · до 20 файлів за раз

Файл також можна вставити через Ctrl/Cmd+V або з меню буфера обміну.

PDF у RTF (текст) витягає слова, які вже є текстовими об’єктами. Типовий шлях `txt` використовує той самий локальний екстрактор, що й інші операції pdf-core (`pdfio::extract_text`), і повертає `text/plain`. Без OCR і без LibreOffice.

Якщо обрати `rtf`, файл іде через LibreOffice `writer_pdf_import`. Цей шлях потребує `soffice` на сервері й будує грубий rich text. Заміна шрифтів і зсув таблиць звичні. Вважайте RTF чернеткою.

Суто зображені скани дають порожній або майже порожній `.txt`. OCR на сайті повертає Markdown, а не пошуковий PDF для повторної подачі сюди.

Поля діапазону сторінок немає. Читаються всі сторінки. Файли, захищені паролем, на цій сторінці розблоковуються за вас, щойно ви введете пароль; виклики через API спочатку виконують «Зняти пароль».

Для заголовків і списків, а не чистого тексту — «PDF у Markdown». Для таблиць рядками — «PDF у CSV» або «PDF у Excel».

Вивантаження тимчасові. Текстової бібліотеки ми не зберігаємо.

Що вміє

  • Типовий TXT — локальне витягання тексту, не pdftotext і не OCR
  • Опційний RTF через LibreOffice `writer_pdf_import`
  • Читає всі сторінки; без параметра діапазону
  • Анонімний API: /api/v1/convert/pdf/text

Коли брати цей інструмент

  • Швидко витягнути plain text
  • Чорновий RTF через LibreOffice
  • Передати текст у пошук/індекс

Як витягти текст із PDF?

  1. Вивантажте PDF із текстовим шаром.
  2. Залиште TXT або оберіть RTF.
  3. Натисніть «Обробити» й завантажте результат.
  4. Для сканів використайте OCR, не цей шлях.

Обмеження і межі

  • Не OCR
  • Немає діапазону сторінок
  • RTF — приблизна верстка
  • Обмеження завантаження на цьому сайті: 500 МБ на файл; якщо файл більший за приблизно 95 МБ, він надсилається частинами. Тіло одного прямого запиту до API — не більше 100 МБ.

Приклади

  • Текстовий PDF → .txt із вмістом
  • Скан → порожній або майже порожній .txt

Приватність цього інструмента

Файли надсилаються через HTTPS, обробляються в оперативній пам’яті або в короткочасному тимчасовому каталозі на наших серверах і видаляються, щойно результат готовий. Копій для подальшого перегляду, навчання моделей чи рекламних профілів ми не зберігаємо. Строки зберігання та відомості про файли cookie AdSense наведені в Політиці конфіденційності.

Часті запитання

Чому порожній txt?
Немає текстових об’єктів. Скан → OCR.
Чи викликає pdftotext для TXT?
Ні. Локальний pdfio::extract_text.
RTF = Word?
Грубий імпорт LibreOffice; беріть як чернетку.
Чи можна діапазон сторінок?
Ні. Усі сторінки.

Востаннє оновлено:

Виклик із коду

Кожен інструмент на сайті - звичайний REST-інтерфейс. Для анонімної роботи не потрібні обліковий запис чи ключ API. І для браузера, і для розробників, і для програмних агентів.

curl -X POST "https://pdf123.xyz/api/v1/convert/pdf/text" \
  -F "[email protected]" \
  -F "outputFormat=txt" \
  -o output.pdf

Також є як MCP-інструмент для клієнтів із Model Context Protocol (JSON-RPC 2.0 через POST /mcp). Повний довідник API

Використати через ШІ-агента

Скіл

З цим скілом Claude Code, Codex, Cursor та інші ШІ-агенти зможуть виконати «PDF у RTF (текст)» замість вас: /skills/pdf123-pdf-to-text.md

Усі скіли для агентів

Файли потрібні лише для цієї обробки й потім стираються самі.