Przejdź do głównej treści
PPDF123

OCR zeskanowanego PDF do Markdown

OCR do Markdown odczytuje zeskanowany lub obrazowy PDF i zwraca jego tekst jako plik Markdown. Nie dodaje warstwy tekstu do PDF, a oryginalny plik pozostaje bez zmian.

Przeciągnij pliki tutaj albo kliknij, żeby wybrać

Obsługiwane: PDF · do 500.0 MB na plik · maks. 20 plików naraz

Możesz też wkleić plik przez Ctrl/Cmd+V lub z menu schowka.

OCR czyta zeskanowany lub obrazkowy PDF i zwraca Markdown (`text/markdown`, nazwa `.md`). Nie wpisuje ukrytej warstwy tekstu z powrotem do PDF, nie prostuje ani nie czyści skanu.

Serwer łączy natywny tekst już obecny w PDF z rozpoznaniem optycznym stron-obrazów. Force OCR (`ocrType=force-ocr`, domyślnie na stronie) ponownie rozpoznaje każdą stronę. Normal (wszystko poza `force-ocr`) używa natywnego tekstu, gdy jest, i robi OCR tylko na czysto obrazkowych stronach. Na czystym elektronicznym PDF Auto nie ładuje środowiska OCR.

Dokładność zależy od jakości skanu, kontrastu i przechylenia. Obecny silnik nie ma parametru języka. Jeśli klient nadal wysyła stare pola Java OCRmyPDF (`languages`, `deskew`, `clean`, `sidecar`), są ignorowane.

To nie jest krok przed PDF na Word ani PDF na RTF (tekst). Te narzędzia nadal wymagają tekstu wewnątrz PDF. Tutaj OCR to równoległe wyodrębnianie: dostajesz Markdown, oryginalny PDF się nie zmienia.

Nie rób OCR na plikach, których nie masz prawa digitalizować ani dalej rozpowszechniać. Wyciągnięty tekst podlega tym samym regułom praw autorskich i miejscu pracy.

Jeśli chcesz przeszukiwalny PDF, tego tu nie dostaniesz. Przeszukiwalnym produktem jest plik Markdown. Otwórz go w edytorze i sprawdź nazwiska oraz liczby, które muszą być dokładne.

Zdjęcia z telefonu najlepiej przytnij i wyprostuj przed przesłaniem. Trapezoidalne ujęcia marnują rozpoznanie na tle. OCR nie tłumaczy: rozpoznaje znaki, nie przepisuje dokumentu na inny język.

Zadanie działa na serwerze. Pobierz wynik w porę. Nie budujemy biblioteki OCR z Twoich plików. Pliki chronione hasłem są odblokowywane za Ciebie na tej stronie, gdy tylko wpiszesz hasło; wywołujący API najpierw uruchamiają Usuń hasło.

Funkcje

  • Zwraca Markdown, nie PDF z warstwą OCR
  • Force OCR czyta każdą stronę ponownie; Normal/Auto używa natywnego tekstu, gdy jest
  • Oryginalny PDF się nie zmienia
  • Anonimowe API: /api/v1/misc/ocr-pdf

Kiedy tego użyć

  • Wyciągnąć treść klauzul z archiwalnego skanu
  • Przekazać skan agentowi lub łańcuchowi oczekującemu Markdown
  • Odzyskać tekst z czysto obrazkowego PDF bez warstwy tekstu

Jak zrobić OCR zeskanowanego PDF?

  1. Prześlij zeskanowany PDF lub zdjęcie z telefonu zapisane jako PDF.
  2. Wybierz Force OCR (domyślnie) albo Normal/Auto.
  3. Kliknij Przetwórz i pobierz plik `.md`.
  4. W Markdown sprawdź nazwiska i liczby przed użyciem.

Ograniczenia i przypadki brzegowe

  • Dokładność zależy od jakości obrazu
  • Wiele stron trwa dłużej
  • Obecny silnik nie ma parametru języka
  • To nie lokalna biblioteka OCR ani offline SDK
  • Limit przesyłania na tej stronie: 500 MB na plik, wysyłane porcjami powyżej około 95 MB. Treść pojedynczego bezpośredniego żądania API jest ograniczona do 100 MB.

Przykłady

  • 20-stronicowy skan umowy w skali szarości staje się plikiem Markdown z treścią klauzul
  • Przechylone zdjęcie z telefonu może wymagać ponownego ujęcia, zanim OCR będzie użyteczny

Prywatność tego narzędzia

Pliki są przesyłane przez HTTPS, przetwarzane w pamięci lub w krótkotrwałym katalogu tymczasowym na naszych serwerach i usuwane, gdy wynik jest gotowy. Nie przechowujemy kopii do późniejszego przeglądania, trenowania ani profili reklamowych. Szczegóły retencji i pliki cookie AdSense znajdują się w polityce prywatności.

Najczęstsze pytania

Czy OCR zmienia wygląd stron?
Nie zwraca PDF. Oryginał zostaje; dostajesz osobne pobranie Markdown.
Czy to biblioteka OCR do osadzenia?
Nie. To zadanie HTTP pod /api/v1/misc/ocr-pdf. Zobacz /developers. To nie jest linkowalny SDK.
Czy po OCR mogę przejść na Word?
Nie jako łańcuch PDF. OCR daje Markdown. PDF na Word nadal wymaga PDF z warstwą tekstu.
Czy elektroniczny PDF wymaga Force OCR?
Zwykle nie. Normal/Auto użyje istniejącego tekstu i pominie środowisko OCR. Force, gdy warstwa tekstu jest uszkodzona lub niewiarygodna.

Ostatnia aktualizacja:

Wywołanie z kodu

Każde narzędzie na stronie to zwykły interfejs REST. Anonimowo nie trzeba konta ani klucza API. Działa w przeglądarce, u programistów i u agentów AI.

curl -X POST "https://pdf123.xyz/api/v1/misc/ocr-pdf" \
  -F "[email protected]" \
  -F "ocrType=force-ocr" \
  -o output.pdf

Dostępne też jako narzędzie MCP dla klientów mówiących Model Context Protocol (JSON-RPC 2.0, POST /mcp). Pełna dokumentacja API

Użyj go z agentem AI

Skill

Z tym skillem Claude Code, Codex, Cursor i inne agenty AI mogą wykonać za Ciebie „OCR do Markdown”: /skills/pdf123-ocr.md

Wszystkie skille dla agentów

Pliki służą tylko do tego zadania i są potem automatycznie usuwane.