Към основното съдържание
PPDF123

Превърнете PDF в текст

PDF към текст извлича текста, който вече съществува в PDF, и го връща като обикновен .txt файл или като RTF. Не пуска OCR, затова сканове само с изображения излизат празни.

Плъзнете файлове тук или кликнете, за да изберете

Приема PDF · до 500.0 MB на файл · до 20 файла наведнъж

Можете също да поставите файл с Ctrl/Cmd+V или от менюто на клипборда.

PDF към RTF (текст) извлича думи, които вече съществуват като текстови обекти. Подразбиращият се път `txt` ползва същия локален извличач като други pdf-core операции (`pdfio::extract_text`) и връща `text/plain`. Не пуска OCR и не вика LibreOffice.

При избор `rtf` файлът минава през LibreOffice `writer_pdf_import`. Този път изисква `soffice` на сървъра и възстановява груб богат текст. Заместване на шрифтове и разместени таблици са обичайни. Гледайте RTF като чернова.

Чисто изображенните сканове дават празен или почти празен `.txt`. «OCR към Markdown» на сайта връща Markdown, не претърсим PDF, който да се върне тук.

На страницата няма поле за диапазон страници. Чете се всяка страница. Файловете, защитени с парола, се отключват вместо вас на тази страница, щом въведете паролата; при API първо пуснете «Премахване на парола».

За заглавия и списъци вместо чист текст ползвайте «PDF към Markdown». За таблици като редове — «PDF към CSV» или «PDF към Excel».

Качванията са временни. Не пазим текстова библиотека.

Възможности

  • Подразбиращ се TXT през локално извличане — не pdftotext и не OCR
  • Опционален RTF през LibreOffice `writer_pdf_import`
  • Чете всяка страница; няма параметър за диапазон
  • Анонимен API: /api/v1/convert/pdf/text

Кога да го използвате

  • Отчет с текст слой към grep или скрипт
  • Груба RTF чернова от електронна бележка
  • Проверка дали PDF изобщо има текст слой

Как да извлека текст от PDF?

  1. Качете PDF с избираем текст.
  2. Запазете TXT или изберете RTF, когато ви трябва груба LibreOffice чернова.
  3. Стартирайте обработката и изтеглете `.txt` или `.rtf`.
  4. Проверете няколко абзаца. Сканове без текст слой изглеждат празни.

Ограничения и крайни случаи

  • Не е OCR; скановете почти не дават текст
  • Няма контрол за диапазон страници
  • TXT не възстановява визуалния ред на многоколонен макет
  • Ограничение за качване на този сайт: 500 MB на файл; над около 95 MB файлът се изпраща на части. Тялото на една пряка API заявка е ограничено до 100 MB.

Примери

  • Избираем годишен отчет обикновено дава дълъг .txt
  • PDF от снимка на дъска обикновено дава празен или мъничък файл

Поверителност при този инструмент

Файловете се качват по HTTPS, обработват се в паметта или в краткоживуща временна директория на нашите сървъри и се изтриват, щом резултатът е готов. Не задържаме копия за по-късен преглед, обучение на модели или рекламни профили. Сроковете за съхранение и обясненията за бисквитките на AdSense са в Политиката за поверителност.

Често задавани въпроси

Защо текстовият файл е празен?
В PDF няма текстови обекти за извличача. Скановете искат «OCR към Markdown». Този Markdown не се подава обратно тук.
TXT същото ли е като копиране от преглеждач?
Близко, но не идентично. Редът следва как текстът е записан в потока на съдържанието. Многоколонният макет може да се разминава с визуалния ред на четене.
Кога да избера RTF?
Само когато искате LibreOffice да възстанови документ. TXT е пряко извличане без soffice.
Запазват ли се шрифтове и макет?
TXT е чист текст. RTF е приблизително възстановяване, не пикселно съвпадение.

Последна актуализация:

Извикване от код

Всеки инструмент е обикновен REST интерфейс. За анонимна употреба не трябват профил или API ключ. Работи еднакво в браузър, за разработчици и за AI агенти.

curl -X POST "https://pdf123.xyz/api/v1/convert/pdf/text" \
  -F "[email protected]" \
  -F "outputFormat=txt" \
  -o output.pdf

Наличен е и като MCP инструмент за клиенти с Model Context Protocol (JSON-RPC 2.0 през POST /mcp). Пълна API документация

Използвайте го чрез AI агент

Скил

С този скил Claude Code, Codex, Cursor и други AI агенти могат да изпълнят „PDF към RTF (текст)“ вместо вас: /skills/pdf123-pdf-to-text.md

Всички скилове за агенти

Файловете служат само за тази обработка и после се изтриват автоматично.