Закрашивание страниц PDF по поисковым словам
«Закрасить текст» заменяет сплошной чёрной страницей каждую страницу, в тексте которой есть один из ваших терминов. Регистр не учитывается, а прежнее содержимое закрашенной страницы удаляется. Работает с текстовым слоем, не со сканами.
Перетащите файлы сюда или нажмите, чтобы выбрать
Форматы: PDF · до 500.0 MB на файл · до 20 файлов за раз
Файл можно также вставить через Ctrl/Cmd+V или из меню буфера обмена.
Закрашивание текста читает текст каждой страницы и сравнивает его с вашими терминами через запятую. Сопоставление — проверка подстроки без учёта регистра, поэтому `acme` находит и `ACME Corp`. Каждая совпавшая страница заменяется сплошной чёрной страницей. Это закрашивание на уровне страницы, а не слова.
На совпавшей странице прежнее содержимое, ресурсы и аннотации отсоединяются, поэтому скрытые слова с этой страницы извлечь нельзя. Заливка зафиксирована как чёрная (`#000000`); поле цвета игнорируется.
Инструмент также вычищает то, что закрашенная страница оставляет в других местах файла: поля формы на ней, закладки, которые на неё указывают или содержат термин, подходящие записи информации о документе, XMP-метаданные закрашенных страниц и текст структурного дерева. Вложенные файлы, JavaScript и текст на страницах без совпадений не затрагиваются; первые два убирает «Очистить PDF».
Пустой список терминов отклоняется с ошибкой. Страницы без совпадений, включая сканы из одних изображений без текстового слоя, остаются без изменений. OCR нет, поэтому отсканированную страницу можно убрать только через «Удалить страницы».
API также принимает `caseSensitive=true` и `useRegex=true` (синтаксис регулярных выражений Rust, не более 200 терминов через запятую). В форме на сайте есть только список терминов. Файлы, защищённые паролем, снимаются с защиты прямо на этой странице, как только вы введёте пароль; при работе через API сначала запустите «Снять пароль».
Загрузка временная. Библиотеку PDF мы не храним.
Функции
- Сопоставление терминов без учёта регистра; каждая совпавшая страница становится чёрной
- Удаляет прежнее содержимое страницы, поля формы, подходящие названия закладок и метаданные
- Пустой список терминов отклоняется; страницы без совпадений не меняются
- Анонимный API: /api/v1/security/auto-redact
Когда применять
- Закрасить страницы с именем клиента или номером счёта перед тем, как поделиться файлом
- Убрать из длинной выгрузки страницы с персональными идентификаторами
- Подготовить копию для рецензии, в которой чувствительные страницы нельзя восстановить
Как закрасить страницы в PDF?
- Загрузите PDF с текстовым слоем, который вам разрешено менять.
- Введите термины через запятую, например имя клиента или номер счёта. Регистр при сопоставлении не учитывается.
- Нажмите «Обработать». Каждая страница, где встречается термин, станет сплошной чёрной страницей.
- Откройте результат, проверьте, какие страницы стали чёрными, и ещё раз поищите в нём термины, прежде чем делиться файлом.
Ограничения и особые случаи
- Только на уровне страницы; частичной закраски внутри страницы нет
- Нужен текстовый слой: страницы из одних изображений не совпадают никогда
- Пустой список терминов — ошибка
- Вложенные файлы и JavaScript не удаляются; для них — «Очистить PDF»
- Слова, нарисованные векторными фигурами, не содержат текста для сопоставления
- Лимит загрузки на сайте: 500 МБ на файл, файлы крупнее примерно 95 МБ отправляются частями. Тело одного прямого запроса к API ограничено 100 МБ.
Примеры
- Термин secret закрасит страницу 2, только если извлечённый текст этой страницы содержит secret в любом регистре
- Термины alpha,beta закрасят каждую страницу, где есть любое из двух слов
Конфиденциальность этого инструмента
Файлы загружаются по HTTPS, обрабатываются в памяти или в короткоживущем временном каталоге на наших серверах и удаляются, когда результат готов. Копии для последующего просмотра, обучения моделей или рекламных профилей мы не храним. Сроки хранения и сведения о cookie AdSense указаны в Политике конфиденциальности.
Частые вопросы
- Почему вся страница стала чёрной?
- Закрашивание работает на уровне страницы. Любая страница, текст которой содержит термин, заменяется чёрной страницей, так что на ней ничего не остаётся.
- Можно закрасить одно слово и оставить остальное на странице?
- Нет. Закрашивается вся совпавшая страница; закраски отдельных слов по рамке нет.
- Текст действительно удаляется из файла?
- На совпавших страницах содержимое, ресурсы и аннотации заменяются, так что текста на странице больше нет. Значения полей формы, подходящие названия закладок, записи Info и метаданные тоже вычищаются. Вложенные файлы и страницы без совпадений не затрагиваются.
- Учитывается ли регистр при сопоставлении?
- Нет. По умолчанию термины совпадают независимо от регистра. Через API можно передать caseSensitive=true или useRegex=true для регулярных выражений.
- Справится ли «Закрасить текст» со сканом?
- Напрямую нет. Инструмент читает текстовый слой, а скан без него остаётся без изменений. Шага OCR нет.
Последнее обновление:
Вызов из кода
Каждый инструмент на сайте: обычный REST. Анонимно не нужны ни аккаунт, ни ключ API. И для браузера, и для разработчиков, и для ИИ-агентов.
curl -X POST "https://pdf123.xyz/api/v1/security/auto-redact" \
-F "[email protected]" \
-F "listOfText=your-listOfText" \
-o output.pdfЕсть и как MCP-инструмент для клиентов на Model Context Protocol (JSON-RPC 2.0, POST /mcp). Полное описание API
Использовать через ИИ-агента
СкиллС этим скиллом Claude Code, Codex, Cursor и другие ИИ-агенты смогут выполнить «Закрасить текст» за вас: /skills/pdf123-auto-redact.md
Файлы нужны только для этой обработки и потом удаляются.