Перетворення PDF на текст
PDF у RTF (текст) витягує текст, що вже є в PDF, і повертає його звичайним файлом .txt або як RTF. OCR він не виконує, тож скани лише із зображень виходять порожніми.
Перетягніть файли сюди або натисніть, щоб вибрати
Формати: PDF · до 500.0 MB на файл · до 20 файлів за раз
Файл також можна вставити через Ctrl/Cmd+V або з меню буфера обміну.
PDF у RTF (текст) витягає слова, які вже є текстовими об’єктами. Типовий шлях `txt` використовує той самий локальний екстрактор, що й інші операції pdf-core (`pdfio::extract_text`), і повертає `text/plain`. Без OCR і без LibreOffice.
Якщо обрати `rtf`, файл іде через LibreOffice `writer_pdf_import`. Цей шлях потребує `soffice` на сервері й будує грубий rich text. Заміна шрифтів і зсув таблиць звичні. Вважайте RTF чернеткою.
Суто зображені скани дають порожній або майже порожній `.txt`. OCR на сайті повертає Markdown, а не пошуковий PDF для повторної подачі сюди.
Поля діапазону сторінок немає. Читаються всі сторінки. Файли, захищені паролем, на цій сторінці розблоковуються за вас, щойно ви введете пароль; виклики через API спочатку виконують «Зняти пароль».
Для заголовків і списків, а не чистого тексту — «PDF у Markdown». Для таблиць рядками — «PDF у CSV» або «PDF у Excel».
Вивантаження тимчасові. Текстової бібліотеки ми не зберігаємо.
Що вміє
- Типовий TXT — локальне витягання тексту, не pdftotext і не OCR
- Опційний RTF через LibreOffice `writer_pdf_import`
- Читає всі сторінки; без параметра діапазону
- Анонімний API: /api/v1/convert/pdf/text
Коли брати цей інструмент
- Швидко витягнути plain text
- Чорновий RTF через LibreOffice
- Передати текст у пошук/індекс
Як витягти текст із PDF?
- Вивантажте PDF із текстовим шаром.
- Залиште TXT або оберіть RTF.
- Натисніть «Обробити» й завантажте результат.
- Для сканів використайте OCR, не цей шлях.
Обмеження і межі
- Не OCR
- Немає діапазону сторінок
- RTF — приблизна верстка
- Обмеження завантаження на цьому сайті: 500 МБ на файл; якщо файл більший за приблизно 95 МБ, він надсилається частинами. Тіло одного прямого запиту до API — не більше 100 МБ.
Приклади
- Текстовий PDF → .txt із вмістом
- Скан → порожній або майже порожній .txt
Приватність цього інструмента
Файли надсилаються через HTTPS, обробляються в оперативній пам’яті або в короткочасному тимчасовому каталозі на наших серверах і видаляються, щойно результат готовий. Копій для подальшого перегляду, навчання моделей чи рекламних профілів ми не зберігаємо. Строки зберігання та відомості про файли cookie AdSense наведені в Політиці конфіденційності.
Часті запитання
- Чому порожній txt?
- Немає текстових об’єктів. Скан → OCR.
- Чи викликає pdftotext для TXT?
- Ні. Локальний pdfio::extract_text.
- RTF = Word?
- Грубий імпорт LibreOffice; беріть як чернетку.
- Чи можна діапазон сторінок?
- Ні. Усі сторінки.
Востаннє оновлено:
Виклик із коду
Кожен інструмент на сайті - звичайний REST-інтерфейс. Для анонімної роботи не потрібні обліковий запис чи ключ API. І для браузера, і для розробників, і для програмних агентів.
curl -X POST "https://pdf123.xyz/api/v1/convert/pdf/text" \
-F "[email protected]" \
-F "outputFormat=txt" \
-o output.pdfТакож є як MCP-інструмент для клієнтів із Model Context Protocol (JSON-RPC 2.0 через POST /mcp). Повний довідник API
Використати через ШІ-агента
СкілЗ цим скілом Claude Code, Codex, Cursor та інші ШІ-агенти зможуть виконати «PDF у RTF (текст)» замість вас: /skills/pdf123-pdf-to-text.md
Файли потрібні лише для цієї обробки й потім стираються самі.