Перейти до основного вмісту
PPDF123

OCR сканованого PDF у Markdown

OCR у Markdown читає скановану або графічну PDF і повертає її текст як файл Markdown. Він не додає текстовий шар до PDF, а вихідний файл не змінюється.

Перетягніть файли сюди або натисніть, щоб вибрати

Формати: PDF · до 500.0 MB на файл · до 20 файлів за раз

Файл також можна вставити через Ctrl/Cmd+V або з меню буфера обміну.

OCR читає відсканований або суто зображений PDF і повертає Markdown (`text/markdown`, ім’я файлу `.md`). Він не записує прихований текстовий шар назад у PDF і не чистить, не вирівнює й не переписує скан.

Сервер зводить наявний у PDF нативний текст із результатами оптичного розпізнавання сторінок-зображень. Force OCR (`ocrType=force-ocr`, типово на сайті) перечитує кожну сторінку. Normal (усе, що не `force-ocr`) бере нативний текст, де він є, і робить OCR лише на чисто графічних сторінках. На чистому електронному PDF Auto не підіймає середовище OCR.

Точність залежить від якості скану, контрасту й нахилу. У поточного рушія немає параметра мови. Якщо клієнт ще надсилає старі поля Java OCRmyPDF (`languages`, `deskew`, `clean`, `sidecar`), вони ігноруються.

Це не попередній крок до «PDF у Word» чи «PDF у RTF (текст)». Тим інструментам і далі потрібен текст усередині PDF. Тут OCR — паралельне витягання: ви отримуєте Markdown, оригінальний PDF не змінюється.

Не робіть OCR файлів, які вам не дозволено оцифровувати чи далі поширювати. Витягнутий текст так само підпадає під авторське право й правила робочого місця.

Хто хоче «пошуковий PDF», тут його не отримає. Результат — файл Markdown. Відкрийте в редакторі й перевірте імена та цифри, які мають бути точними.

Телефонні знімки бажано спочатку обрізати й вирівняти. Трапецієподібні кадри витрачають розпізнавання на тло. OCR — не переклад: він читає символи й не переписує документ іншою мовою.

Завдання виконується на сервері. Завантажте результат вчасно. OCR-бібліотеки ваших файлів ми не будуємо. Файли, захищені паролем, на цій сторінці розблоковуються за вас, щойно ви введете пароль; виклики через API спочатку виконують «Зняти пароль».

Що вміє

  • Повертає Markdown, а не PDF із шаром OCR
  • Force OCR перечитує кожну сторінку; Normal/Auto бере нативний текст, де він є
  • Оригінальний PDF не змінюється
  • Анонімний API: /api/v1/misc/ocr-pdf

Коли брати цей інструмент

  • Витягнути текст пунктів з архівного скану
  • Передати скан агенту чи конвеєру, якому потрібен Markdown
  • Повернути слова з суто зображеного PDF без текстового шару

Як виконати OCR сканованого PDF?

  1. Вивантажте скан або PDF зі знімків телефоном.
  2. Оберіть Force OCR (типово) або Normal/Auto.
  3. Натисніть «Обробити» й завантажте файл `.md`.
  4. У Markdown перевірте імена та цифри перед використанням.

Обмеження і межі

  • Точність залежить від якості зображення
  • Багато сторінок займає більше часу
  • У поточного рушія немає параметра мови
  • Не локальна бібліотека OCR і не офлайн-SDK
  • Обмеження завантаження на цьому сайті: 500 МБ на файл; якщо файл більший за приблизно 95 МБ, він надсилається частинами. Тіло одного прямого запиту до API — не більше 100 МБ.

Приклади

  • 20-сторінковий сірий скан договору стає Markdown із текстом пунктів
  • Нахилений знімок телефоном може знадобитися перезняти, перш ніж OCR стане корисним

Приватність цього інструмента

Файли надсилаються через HTTPS, обробляються в оперативній пам’яті або в короткочасному тимчасовому каталозі на наших серверах і видаляються, щойно результат готовий. Копій для подальшого перегляду, навчання моделей чи рекламних профілів ми не зберігаємо. Строки зберігання та відомості про файли cookie AdSense наведені в Політиці конфіденційності.

Часті запитання

Чи змінює OCR вигляд сторінок?
Він не повертає PDF. Оригінал не змінюється; окремо отримуєте завантаження Markdown.
Чи це вбудовувана бібліотека OCR?
Ні. Це HTTP-завдання на /api/v1/misc/ocr-pdf. Див. /developers. Це не підключаємий SDK.
Чи можна після OCR зробити «PDF у Word»?
Не як PDF-конвеєр. OCR дає Markdown. «PDF у Word» і далі потребує PDF із текстовим шаром.
Чи потрібен Force OCR для електронного PDF?
Зазвичай ні. Normal/Auto візьме наявний текст і пропустить середовище OCR. Force — коли текстовий шар пошкоджений або ненадійний.

Востаннє оновлено:

Виклик із коду

Кожен інструмент на сайті - звичайний REST-інтерфейс. Для анонімної роботи не потрібні обліковий запис чи ключ API. І для браузера, і для розробників, і для програмних агентів.

curl -X POST "https://pdf123.xyz/api/v1/misc/ocr-pdf" \
  -F "[email protected]" \
  -F "ocrType=force-ocr" \
  -o output.pdf

Також є як MCP-інструмент для клієнтів із Model Context Protocol (JSON-RPC 2.0 через POST /mcp). Повний довідник API

Використати через ШІ-агента

Скіл

З цим скілом Claude Code, Codex, Cursor та інші ШІ-агенти зможуть виконати «OCR у Markdown» замість вас: /skills/pdf123-ocr.md

Усі скіли для агентів

Файли потрібні лише для цієї обробки й потім стираються самі.