OCR сканованого PDF у Markdown
OCR у Markdown читає скановану або графічну PDF і повертає її текст як файл Markdown. Він не додає текстовий шар до PDF, а вихідний файл не змінюється.
Перетягніть файли сюди або натисніть, щоб вибрати
Формати: PDF · до 500.0 MB на файл · до 20 файлів за раз
Файл також можна вставити через Ctrl/Cmd+V або з меню буфера обміну.
OCR читає відсканований або суто зображений PDF і повертає Markdown (`text/markdown`, ім’я файлу `.md`). Він не записує прихований текстовий шар назад у PDF і не чистить, не вирівнює й не переписує скан.
Сервер зводить наявний у PDF нативний текст із результатами оптичного розпізнавання сторінок-зображень. Force OCR (`ocrType=force-ocr`, типово на сайті) перечитує кожну сторінку. Normal (усе, що не `force-ocr`) бере нативний текст, де він є, і робить OCR лише на чисто графічних сторінках. На чистому електронному PDF Auto не підіймає середовище OCR.
Точність залежить від якості скану, контрасту й нахилу. У поточного рушія немає параметра мови. Якщо клієнт ще надсилає старі поля Java OCRmyPDF (`languages`, `deskew`, `clean`, `sidecar`), вони ігноруються.
Це не попередній крок до «PDF у Word» чи «PDF у RTF (текст)». Тим інструментам і далі потрібен текст усередині PDF. Тут OCR — паралельне витягання: ви отримуєте Markdown, оригінальний PDF не змінюється.
Не робіть OCR файлів, які вам не дозволено оцифровувати чи далі поширювати. Витягнутий текст так само підпадає під авторське право й правила робочого місця.
Хто хоче «пошуковий PDF», тут його не отримає. Результат — файл Markdown. Відкрийте в редакторі й перевірте імена та цифри, які мають бути точними.
Телефонні знімки бажано спочатку обрізати й вирівняти. Трапецієподібні кадри витрачають розпізнавання на тло. OCR — не переклад: він читає символи й не переписує документ іншою мовою.
Завдання виконується на сервері. Завантажте результат вчасно. OCR-бібліотеки ваших файлів ми не будуємо. Файли, захищені паролем, на цій сторінці розблоковуються за вас, щойно ви введете пароль; виклики через API спочатку виконують «Зняти пароль».
Що вміє
- Повертає Markdown, а не PDF із шаром OCR
- Force OCR перечитує кожну сторінку; Normal/Auto бере нативний текст, де він є
- Оригінальний PDF не змінюється
- Анонімний API: /api/v1/misc/ocr-pdf
Коли брати цей інструмент
- Витягнути текст пунктів з архівного скану
- Передати скан агенту чи конвеєру, якому потрібен Markdown
- Повернути слова з суто зображеного PDF без текстового шару
Як виконати OCR сканованого PDF?
- Вивантажте скан або PDF зі знімків телефоном.
- Оберіть Force OCR (типово) або Normal/Auto.
- Натисніть «Обробити» й завантажте файл `.md`.
- У Markdown перевірте імена та цифри перед використанням.
Обмеження і межі
- Точність залежить від якості зображення
- Багато сторінок займає більше часу
- У поточного рушія немає параметра мови
- Не локальна бібліотека OCR і не офлайн-SDK
- Обмеження завантаження на цьому сайті: 500 МБ на файл; якщо файл більший за приблизно 95 МБ, він надсилається частинами. Тіло одного прямого запиту до API — не більше 100 МБ.
Приклади
- 20-сторінковий сірий скан договору стає Markdown із текстом пунктів
- Нахилений знімок телефоном може знадобитися перезняти, перш ніж OCR стане корисним
Приватність цього інструмента
Файли надсилаються через HTTPS, обробляються в оперативній пам’яті або в короткочасному тимчасовому каталозі на наших серверах і видаляються, щойно результат готовий. Копій для подальшого перегляду, навчання моделей чи рекламних профілів ми не зберігаємо. Строки зберігання та відомості про файли cookie AdSense наведені в Політиці конфіденційності.
Часті запитання
- Чи змінює OCR вигляд сторінок?
- Він не повертає PDF. Оригінал не змінюється; окремо отримуєте завантаження Markdown.
- Чи це вбудовувана бібліотека OCR?
- Ні. Це HTTP-завдання на /api/v1/misc/ocr-pdf. Див. /developers. Це не підключаємий SDK.
- Чи можна після OCR зробити «PDF у Word»?
- Не як PDF-конвеєр. OCR дає Markdown. «PDF у Word» і далі потребує PDF із текстовим шаром.
- Чи потрібен Force OCR для електронного PDF?
- Зазвичай ні. Normal/Auto візьме наявний текст і пропустить середовище OCR. Force — коли текстовий шар пошкоджений або ненадійний.
Востаннє оновлено:
Виклик із коду
Кожен інструмент на сайті - звичайний REST-інтерфейс. Для анонімної роботи не потрібні обліковий запис чи ключ API. І для браузера, і для розробників, і для програмних агентів.
curl -X POST "https://pdf123.xyz/api/v1/misc/ocr-pdf" \
-F "[email protected]" \
-F "ocrType=force-ocr" \
-o output.pdfТакож є як MCP-інструмент для клієнтів із Model Context Protocol (JSON-RPC 2.0 через POST /mcp). Повний довідник API
Використати через ШІ-агента
СкілЗ цим скілом Claude Code, Codex, Cursor та інші ШІ-агенти зможуть виконати «OCR у Markdown» замість вас: /skills/pdf123-ocr.md
Файли потрібні лише для цієї обробки й потім стираються самі.