Przejdź do głównej treści
PPDF123

Konwersja PDF na tekst

PDF na RTF (tekst) wyodrębnia tekst, który już istnieje w PDF, i zwraca go jako zwykły plik .txt albo jako RTF. Nie uruchamia OCR, więc skany z samych obrazów wychodzą puste.

Przeciągnij pliki tutaj albo kliknij, żeby wybrać

Obsługiwane: PDF · do 500.0 MB na plik · maks. 20 plików naraz

Możesz też wkleić plik przez Ctrl/Cmd+V lub z menu schowka.

Konwersja PDF na RTF (tekst) wyciąga słowa, które już są obiektami tekstu. Domyślna ścieżka `txt` używa lokalnego ekstraktora jak inne operacje pdf-core (`pdfio::extract_text`) i zwraca `text/plain`. Nie uruchamia OCR ani LibreOffice.

Przy wyborze `rtf` plik idzie przez LibreOffice `writer_pdf_import`. Ta ścieżka wymaga `soffice` na serwerze i buduje surowy rich text. Podmiany czcionek i krzywe tabele są normą. Traktuj RTF jako szkic.

Czyste skany obrazowe dają pusty lub niemal pusty `.txt`. OCR zwraca Markdown, nie przeszukiwalny PDF do ponownego wrzucenia tutaj.

Na tej stronie nie ma pola zakresu stron. Czytana jest każda strona. Pliki chronione hasłem są odblokowywane za Ciebie na tej stronie, gdy tylko wpiszesz hasło; wywołujący API najpierw uruchamiają Usuń hasło.

Do nagłówków i list zamiast czystego tekstu — PDF na Markdown. Do tabel wierszami — PDF na CSV lub PDF na Excel.

Przesłania są tymczasowe. Nie prowadzimy biblioteki Twoich plików tekstowych.

Funkcje

  • Domyślny TXT: lokalne wyciąganie tekstu, nie pdftotext i nie OCR
  • Opcjonalny RTF przez LibreOffice `writer_pdf_import`
  • Czyta każdą stronę; bez parametru zakresu stron
  • Anonimowe API: /api/v1/convert/pdf/text

Kiedy tego użyć

  • Wrzucić raport z warstwą tekstu do grep lub skryptu
  • Dostać surowy szkic RTF z elektronicznej notatki
  • Sprawdzić, czy PDF w ogóle ma warstwę tekstu

Jak wyodrębnić tekst z PDF?

  1. Prześlij PDF z zaznaczalnym tekstem.
  2. Zostaw TXT albo wybierz RTF, gdy potrzebujesz szkicu rich text z LibreOffice.
  3. Kliknij Przetwórz i pobierz `.txt` lub `.rtf`.
  4. Sprawdź kilka akapitów. Skany bez warstwy tekstu wyglądają na puste.

Ograniczenia i przypadki brzegowe

  • Nie OCR; skany prawie nic nie dają
  • Bez kontroli zakresu stron
  • TXT nie odbudowuje wizualnej kolejności wielokolumnowej
  • Limit przesyłania na tej stronie: 500 MB na plik, wysyłane porcjami powyżej około 95 MB. Treść pojedynczego bezpośredniego żądania API jest ograniczona do 100 MB.

Przykłady

  • Zaznaczalny raport roczny zwykle daje długi .txt
  • PDF ze zdjęciem tablicy zwykle daje pusty lub bardzo mały plik

Prywatność tego narzędzia

Pliki są przesyłane przez HTTPS, przetwarzane w pamięci lub w krótkotrwałym katalogu tymczasowym na naszych serwerach i usuwane, gdy wynik jest gotowy. Nie przechowujemy kopii do późniejszego przeglądania, trenowania ani profili reklamowych. Szczegóły retencji i pliki cookie AdSense znajdują się w polityce prywatności.

Najczęstsze pytania

Dlaczego plik tekstowy jest pusty?
W PDF nie ma obiektów tekstu do odczytu. Skany potrzebują OCR do Markdown. Ten Markdown nie wraca do tego narzędzia.
Czy TXT jest jak kopiuj-wklej z czytnika?
Blisko, ale nie to samo. Kolejność podąża za sposobem przechowania tekstu w strumieniu treści. Wielokolumnowy układ może nie zgadzać się z wizualną kolejnością czytania.
Kiedy wybrać RTF?
Tylko gdy chcesz, by LibreOffice odbudował dokument. TXT to bezpośrednie wyciąganie bez soffice.
Czy zachowa czcionki i układ?
TXT to czysty tekst. RTF to odbudowa na tyle, na ile się da, nie dopasowanie pikselowe.

Ostatnia aktualizacja:

Wywołanie z kodu

Każde narzędzie na stronie to zwykły interfejs REST. Anonimowo nie trzeba konta ani klucza API. Działa w przeglądarce, u programistów i u agentów AI.

curl -X POST "https://pdf123.xyz/api/v1/convert/pdf/text" \
  -F "[email protected]" \
  -F "outputFormat=txt" \
  -o output.pdf

Dostępne też jako narzędzie MCP dla klientów mówiących Model Context Protocol (JSON-RPC 2.0, POST /mcp). Pełna dokumentacja API

Użyj go z agentem AI

Skill

Z tym skillem Claude Code, Codex, Cursor i inne agenty AI mogą wykonać za Ciebie „PDF na RTF (tekst)”: /skills/pdf123-pdf-to-text.md

Wszystkie skille dla agentów

Pliki służą tylko do tego zadania i są potem automatycznie usuwane.