OCR zeskanowanego PDF do Markdown
OCR do Markdown odczytuje zeskanowany lub obrazowy PDF i zwraca jego tekst jako plik Markdown. Nie dodaje warstwy tekstu do PDF, a oryginalny plik pozostaje bez zmian.
Przeciągnij pliki tutaj albo kliknij, żeby wybrać
Obsługiwane: PDF · do 500.0 MB na plik · maks. 20 plików naraz
Możesz też wkleić plik przez Ctrl/Cmd+V lub z menu schowka.
OCR czyta zeskanowany lub obrazkowy PDF i zwraca Markdown (`text/markdown`, nazwa `.md`). Nie wpisuje ukrytej warstwy tekstu z powrotem do PDF, nie prostuje ani nie czyści skanu.
Serwer łączy natywny tekst już obecny w PDF z rozpoznaniem optycznym stron-obrazów. Force OCR (`ocrType=force-ocr`, domyślnie na stronie) ponownie rozpoznaje każdą stronę. Normal (wszystko poza `force-ocr`) używa natywnego tekstu, gdy jest, i robi OCR tylko na czysto obrazkowych stronach. Na czystym elektronicznym PDF Auto nie ładuje środowiska OCR.
Dokładność zależy od jakości skanu, kontrastu i przechylenia. Obecny silnik nie ma parametru języka. Jeśli klient nadal wysyła stare pola Java OCRmyPDF (`languages`, `deskew`, `clean`, `sidecar`), są ignorowane.
To nie jest krok przed PDF na Word ani PDF na RTF (tekst). Te narzędzia nadal wymagają tekstu wewnątrz PDF. Tutaj OCR to równoległe wyodrębnianie: dostajesz Markdown, oryginalny PDF się nie zmienia.
Nie rób OCR na plikach, których nie masz prawa digitalizować ani dalej rozpowszechniać. Wyciągnięty tekst podlega tym samym regułom praw autorskich i miejscu pracy.
Jeśli chcesz przeszukiwalny PDF, tego tu nie dostaniesz. Przeszukiwalnym produktem jest plik Markdown. Otwórz go w edytorze i sprawdź nazwiska oraz liczby, które muszą być dokładne.
Zdjęcia z telefonu najlepiej przytnij i wyprostuj przed przesłaniem. Trapezoidalne ujęcia marnują rozpoznanie na tle. OCR nie tłumaczy: rozpoznaje znaki, nie przepisuje dokumentu na inny język.
Zadanie działa na serwerze. Pobierz wynik w porę. Nie budujemy biblioteki OCR z Twoich plików. Pliki chronione hasłem są odblokowywane za Ciebie na tej stronie, gdy tylko wpiszesz hasło; wywołujący API najpierw uruchamiają Usuń hasło.
Funkcje
- Zwraca Markdown, nie PDF z warstwą OCR
- Force OCR czyta każdą stronę ponownie; Normal/Auto używa natywnego tekstu, gdy jest
- Oryginalny PDF się nie zmienia
- Anonimowe API: /api/v1/misc/ocr-pdf
Kiedy tego użyć
- Wyciągnąć treść klauzul z archiwalnego skanu
- Przekazać skan agentowi lub łańcuchowi oczekującemu Markdown
- Odzyskać tekst z czysto obrazkowego PDF bez warstwy tekstu
Jak zrobić OCR zeskanowanego PDF?
- Prześlij zeskanowany PDF lub zdjęcie z telefonu zapisane jako PDF.
- Wybierz Force OCR (domyślnie) albo Normal/Auto.
- Kliknij Przetwórz i pobierz plik `.md`.
- W Markdown sprawdź nazwiska i liczby przed użyciem.
Ograniczenia i przypadki brzegowe
- Dokładność zależy od jakości obrazu
- Wiele stron trwa dłużej
- Obecny silnik nie ma parametru języka
- To nie lokalna biblioteka OCR ani offline SDK
- Limit przesyłania na tej stronie: 500 MB na plik, wysyłane porcjami powyżej około 95 MB. Treść pojedynczego bezpośredniego żądania API jest ograniczona do 100 MB.
Przykłady
- 20-stronicowy skan umowy w skali szarości staje się plikiem Markdown z treścią klauzul
- Przechylone zdjęcie z telefonu może wymagać ponownego ujęcia, zanim OCR będzie użyteczny
Prywatność tego narzędzia
Pliki są przesyłane przez HTTPS, przetwarzane w pamięci lub w krótkotrwałym katalogu tymczasowym na naszych serwerach i usuwane, gdy wynik jest gotowy. Nie przechowujemy kopii do późniejszego przeglądania, trenowania ani profili reklamowych. Szczegóły retencji i pliki cookie AdSense znajdują się w polityce prywatności.
Najczęstsze pytania
- Czy OCR zmienia wygląd stron?
- Nie zwraca PDF. Oryginał zostaje; dostajesz osobne pobranie Markdown.
- Czy to biblioteka OCR do osadzenia?
- Nie. To zadanie HTTP pod /api/v1/misc/ocr-pdf. Zobacz /developers. To nie jest linkowalny SDK.
- Czy po OCR mogę przejść na Word?
- Nie jako łańcuch PDF. OCR daje Markdown. PDF na Word nadal wymaga PDF z warstwą tekstu.
- Czy elektroniczny PDF wymaga Force OCR?
- Zwykle nie. Normal/Auto użyje istniejącego tekstu i pominie środowisko OCR. Force, gdy warstwa tekstu jest uszkodzona lub niewiarygodna.
Ostatnia aktualizacja:
Wywołanie z kodu
Każde narzędzie na stronie to zwykły interfejs REST. Anonimowo nie trzeba konta ani klucza API. Działa w przeglądarce, u programistów i u agentów AI.
curl -X POST "https://pdf123.xyz/api/v1/misc/ocr-pdf" \
-F "[email protected]" \
-F "ocrType=force-ocr" \
-o output.pdfDostępne też jako narzędzie MCP dla klientów mówiących Model Context Protocol (JSON-RPC 2.0, POST /mcp). Pełna dokumentacja API
Użyj go z agentem AI
SkillZ tym skillem Claude Code, Codex, Cursor i inne agenty AI mogą wykonać za Ciebie „OCR do Markdown”: /skills/pdf123-ocr.md
Pliki służą tylko do tego zadania i są potem automatycznie usuwane.