Konwersja PDF na tekst
PDF na RTF (tekst) wyodrębnia tekst, który już istnieje w PDF, i zwraca go jako zwykły plik .txt albo jako RTF. Nie uruchamia OCR, więc skany z samych obrazów wychodzą puste.
Przeciągnij pliki tutaj albo kliknij, żeby wybrać
Obsługiwane: PDF · do 500.0 MB na plik · maks. 20 plików naraz
Możesz też wkleić plik przez Ctrl/Cmd+V lub z menu schowka.
Konwersja PDF na RTF (tekst) wyciąga słowa, które już są obiektami tekstu. Domyślna ścieżka `txt` używa lokalnego ekstraktora jak inne operacje pdf-core (`pdfio::extract_text`) i zwraca `text/plain`. Nie uruchamia OCR ani LibreOffice.
Przy wyborze `rtf` plik idzie przez LibreOffice `writer_pdf_import`. Ta ścieżka wymaga `soffice` na serwerze i buduje surowy rich text. Podmiany czcionek i krzywe tabele są normą. Traktuj RTF jako szkic.
Czyste skany obrazowe dają pusty lub niemal pusty `.txt`. OCR zwraca Markdown, nie przeszukiwalny PDF do ponownego wrzucenia tutaj.
Na tej stronie nie ma pola zakresu stron. Czytana jest każda strona. Pliki chronione hasłem są odblokowywane za Ciebie na tej stronie, gdy tylko wpiszesz hasło; wywołujący API najpierw uruchamiają Usuń hasło.
Do nagłówków i list zamiast czystego tekstu — PDF na Markdown. Do tabel wierszami — PDF na CSV lub PDF na Excel.
Przesłania są tymczasowe. Nie prowadzimy biblioteki Twoich plików tekstowych.
Funkcje
- Domyślny TXT: lokalne wyciąganie tekstu, nie pdftotext i nie OCR
- Opcjonalny RTF przez LibreOffice `writer_pdf_import`
- Czyta każdą stronę; bez parametru zakresu stron
- Anonimowe API: /api/v1/convert/pdf/text
Kiedy tego użyć
- Wrzucić raport z warstwą tekstu do grep lub skryptu
- Dostać surowy szkic RTF z elektronicznej notatki
- Sprawdzić, czy PDF w ogóle ma warstwę tekstu
Jak wyodrębnić tekst z PDF?
- Prześlij PDF z zaznaczalnym tekstem.
- Zostaw TXT albo wybierz RTF, gdy potrzebujesz szkicu rich text z LibreOffice.
- Kliknij Przetwórz i pobierz `.txt` lub `.rtf`.
- Sprawdź kilka akapitów. Skany bez warstwy tekstu wyglądają na puste.
Ograniczenia i przypadki brzegowe
- Nie OCR; skany prawie nic nie dają
- Bez kontroli zakresu stron
- TXT nie odbudowuje wizualnej kolejności wielokolumnowej
- Limit przesyłania na tej stronie: 500 MB na plik, wysyłane porcjami powyżej około 95 MB. Treść pojedynczego bezpośredniego żądania API jest ograniczona do 100 MB.
Przykłady
- Zaznaczalny raport roczny zwykle daje długi .txt
- PDF ze zdjęciem tablicy zwykle daje pusty lub bardzo mały plik
Prywatność tego narzędzia
Pliki są przesyłane przez HTTPS, przetwarzane w pamięci lub w krótkotrwałym katalogu tymczasowym na naszych serwerach i usuwane, gdy wynik jest gotowy. Nie przechowujemy kopii do późniejszego przeglądania, trenowania ani profili reklamowych. Szczegóły retencji i pliki cookie AdSense znajdują się w polityce prywatności.
Najczęstsze pytania
- Dlaczego plik tekstowy jest pusty?
- W PDF nie ma obiektów tekstu do odczytu. Skany potrzebują OCR do Markdown. Ten Markdown nie wraca do tego narzędzia.
- Czy TXT jest jak kopiuj-wklej z czytnika?
- Blisko, ale nie to samo. Kolejność podąża za sposobem przechowania tekstu w strumieniu treści. Wielokolumnowy układ może nie zgadzać się z wizualną kolejnością czytania.
- Kiedy wybrać RTF?
- Tylko gdy chcesz, by LibreOffice odbudował dokument. TXT to bezpośrednie wyciąganie bez soffice.
- Czy zachowa czcionki i układ?
- TXT to czysty tekst. RTF to odbudowa na tyle, na ile się da, nie dopasowanie pikselowe.
Ostatnia aktualizacja:
Wywołanie z kodu
Każde narzędzie na stronie to zwykły interfejs REST. Anonimowo nie trzeba konta ani klucza API. Działa w przeglądarce, u programistów i u agentów AI.
curl -X POST "https://pdf123.xyz/api/v1/convert/pdf/text" \
-F "[email protected]" \
-F "outputFormat=txt" \
-o output.pdfDostępne też jako narzędzie MCP dla klientów mówiących Model Context Protocol (JSON-RPC 2.0, POST /mcp). Pełna dokumentacja API
Użyj go z agentem AI
SkillZ tym skillem Claude Code, Codex, Cursor i inne agenty AI mogą wykonać za Ciebie „PDF na RTF (tekst)”: /skills/pdf123-pdf-to-text.md
Pliki służą tylko do tego zadania i są potem automatycznie usuwane.