Перейти к основному содержимому
PPDF123

Преобразование PDF в Markdown

«PDF в Markdown» превращает существующий текст PDF в файл .md с заголовками, абзацами и списками там, где их удаётся распознать. OCR не выполняется, поэтому отсканированные страницы выходят пустыми.

Перетащите файлы сюда или нажмите, чтобы выбрать

Форматы: PDF · до 500.0 MB на файл · до 20 файлов за раз

Файл можно также вставить через Ctrl/Cmd+V или из меню буфера обмена.

PDF в Markdown читает уже имеющийся в файле текст через pdf-inspector и отдаёт загрузку `.md` (`text/markdown`). Цель — заголовки, абзацы и списки, а не попиксельная вёрстка.

OCR он не делает. Чисто графические страницы часто выходят пустыми. Для сканов берите OCR в Markdown: тот инструмент смотрит на пиксели и тоже отдаёт `.md`.

Порядок чтения может расходиться с многоколоночной картинкой. Колонтитулы нередко повторяются на каждой странице — удалите их в редакторе. Формулы, которые в PDF были картинками, не становятся LaTeX. В листингах кода часто пропадают отступы.

Это конвертер для docs-as-code, Git-диффов и конвейеров, которым нужен текст. Когда печатная вёрстка сама по себе запись, оставьте PDF. Извлечённый текст всё равно под авторским правом; конвертируйте только то, что вам можно публиковать как текст.

Файлы, защищённые паролем, снимаются с защиты прямо на этой странице, как только вы введёте пароль; при работе через API сначала запустите «Снять пароль». Откройте Markdown и поправьте уровни заголовков до коммита. Markdown в PDF на этом сайте — обратное направление; туда-сюда исходную вёрстку не вернёт.

Загрузки временные. Библиотеку ваших Markdown-файлов мы не храним.

Функции

  • Извлечение нативного текста PDF в Markdown через pdf-inspector
  • Без OCR; для сканов нужен инструмент OCR
  • Скачивание `text/markdown` с именем `.md`
  • Анонимный API: /api/v1/convert/pdf/markdown

Когда применять

  • Перенести PDF README в Git-репозиторий
  • Подать текст статьи в конвейер промптов
  • Набросать веб-текст из PDF-брифа

Как преобразовать PDF в Markdown?

  1. Предпочитайте PDF с текстом. Для сканов используйте OCR в Markdown.
  2. Загрузите PDF и нажмите «Обработать».
  3. Скачайте файл `.md`.
  4. В редакторе поправьте уровни заголовков, повторяющиеся колонтитулы и таблицы.

Ограничения и особые случаи

  • Без OCR; чисто графические страницы почти ничего не дают
  • Верность вёрстки ограничена
  • Сложные таблицы могут потребовать ручной правки
  • Лимит загрузки на сайте: 500 МБ на файл, файлы крупнее примерно 95 МБ отправляются частями. Тело одного прямого запроса к API ограничено 100 МБ.

Примеры

  • Текстовый whitepaper становится файлом .md с абзацами и заголовками
  • Скан без OCR почти не даёт полезного Markdown

Конфиденциальность этого инструмента

Файлы загружаются по HTTPS, обрабатываются в памяти или в короткоживущем временном каталоге на наших серверах и удаляются, когда результат готов. Копии для последующего просмотра, обучения моделей или рекламных профилей мы не храним. Сроки хранения и сведения о cookie AdSense указаны в Политике конфиденциальности.

Частые вопросы

Почему Markdown пустой?
У PDF, скорее всего, нет текстового слоя. Для сканов используйте OCR в Markdown. Этот инструмент читает только текст, уже лежащий в файле.
Это то же самое, что OCR?
Нет. OCR смотрит на страницы-изображения. PDF в Markdown использует pdf-inspector по нативному тексту.
Шрифты сохраняются?
Markdown — это текст плюс лёгкая структура. Шрифты даёт слой, который потом рисует Markdown.
Можно ли вернуть Markdown в PDF?
Да, через Markdown в PDF. Вёрстка не совпадёт с исходным PDF.

Последнее обновление:

Вызов из кода

Каждый инструмент на сайте: обычный REST. Анонимно не нужны ни аккаунт, ни ключ API. И для браузера, и для разработчиков, и для ИИ-агентов.

curl -X POST "https://pdf123.xyz/api/v1/convert/pdf/markdown" \
  -F "[email protected]" \
  -o output.pdf

Есть и как MCP-инструмент для клиентов на Model Context Protocol (JSON-RPC 2.0, POST /mcp). Полное описание API

Использовать через ИИ-агента

Скилл

С этим скиллом Claude Code, Codex, Cursor и другие ИИ-агенты смогут выполнить «PDF в Markdown» за вас: /skills/pdf123-pdf-to-markdown.md

Все скиллы для агентов

Файлы нужны только для этой обработки и потом удаляются.