Отсканированный PDF в Adobe Acrobat открывается как обычная картинка: текст нельзя выделить, скопировать или найти через Ctrl+F. Это верный признак того, что документ не прошёл распознавание — OCR-слой в нём отсутствует, и Acrobat работает со страницей как с фотографией.
Функция распознавания текста (OCR) в Adobe Acrobat превращает изображение в полноценный документ: появляется невидимый текстовый слой, доступный для поиска, копирования и редактирования. Ниже разберём, как запустить распознавание в разных версиях программы, какие настройки выбрать и что делать, если результат получается с ошибками.
Как работает OCR в Adobe Acrobat
Механизм распознавания анализирует изображение страницы, находит области, похожие на символы, и сопоставляет их с буквами выбранного языка. Результат — текстовый слой, который накладывается поверх картинки. Визуально документ не меняется, но становится доступным для поиска и выделения.
Acrobat предлагает несколько режимов вывода. В режиме «Текст и изображения с возможностью поиска» оригинальная картинка сохраняется, а текст добавляется скрытым слоем — это оптимальный вариант для архивных копий. Режим «Редактируемый текст и изображения» заменяет распознанные фрагменты настоящим текстом, что позволяет править документ, но может изменить внешний вид страницы.
Запуск распознавания в Acrobat Pro
В полной версии Acrobat Pro инструмент распознавания доступен через панель Инструменты → Сканирование и OCR. Откройте PDF, выберите этот раздел и нажмите «Распознать текст» — появится выбор: обработать текущий файл или сразу несколько документов пакетно.
Перед запуском стоит проверить настройки: язык документа, разрешение вывода и режим результата. Если скан на русском, а в параметрах выбран английский, кириллица распознается с грубыми ошибками или превратится в бессмысленный набор символов.
☑️ Подготовка к распознаванию
Для обработки части документа укажите диапазон страниц — это ускорит работу на больших файлах. После завершения сохраните результат отдельной копией, чтобы оригинал остался нетронутым.
Распознавание при сканировании
Если документ ещё не отсканирован, удобнее выполнить OCR сразу при создании PDF. В разделе Создать PDF → Сканер активируйте опцию «Распознать текст (OCR)» — Acrobat обработает страницы на лету, и на выходе вы получите уже готовый документ с поиском.
Качество исходного скана напрямую влияет на точность. Рекомендуется сканировать в разрешении не ниже 300 dpi, без перекосов и с хорошим контрастом. Смазанные буквы, пятна и «серый» фон — главные причины ошибок распознавания.
⚠️ Внимание: если скан сделан с наклоном, сначала примените функцию коррекции перекоса (deskew) в настройках сканирования. OCR на кривых строках даёт заметно больше ошибок, и исправлять их вручную придётся дольше, чем пересканировать страницу.
Настройки качества и языка
В диалоге распознавания доступна кнопка «Настройки», где задаются ключевые параметры. Главный из них — язык: Acrobat поддерживает десятки языков, включая русский, и позволяет выбрать несколько одновременно для смешанных документов.
- 🌐 Язык документа — выбирайте точно по содержимому; для русско-английских текстов отметьте оба языка.
- 📄 Режим вывода — «с возможностью поиска» для архива, «редактируемый» для последующей правки.
- 🔍 Разрешение даунсэмплинга — снижение разрешения уменьшает размер файла, но может ухудшить читаемость мелкого шрифта.
- 🛠️ Коррекция перекоса — автоматическое выравнивание строк перед распознаванием.
Обратите внимание: точный набор опций зависит от версии Acrobat (Standard, Pro, DC). Если какого-то пункта нет в вашем диалоге настроек, сверьтесь с официальной справкой Adobe для вашей версии.
Исправление ошибок распознавания
Даже на хороших сканах OCR ошибается: путает «О» и «0», «н» и «й», ломает слова с редкими символами. В Acrobat Pro есть режим «Исправить распознанный текст» — программа подсвечивает сомнительные фрагменты, и их можно проверить и поправить вручную, сверяясь с оригинальным изображением.
Работает это так: сомнительное слово выделяется рамкой, рядом показывается исходная картинка фрагмента, а вы вводите правильный вариант. Для документов, где критична точность (договоры, финансовые отчёты), такой проход обязателен — полностью доверять автоматическому OCR юридически значимые тексты нельзя.
⚠️ Внимание: после ручного исправления сохраните файл отдельной версией. Повторный запуск OCR по уже обработанному документу может перезаписать ваши правки результатами нового автоматического распознавания.
Сравнение режимов вывода OCR
Выбор режима определяет, что можно будет делать с документом дальше. Сравним основные варианты:
| Режим | Поиск и копирование | Редактирование | Внешний вид |
|---|---|---|---|
| Текст и изображения с поиском | Да | Нет | Оригинальный скан |
| Редактируемый текст и изображения | Да | Да | Может измениться |
| Без OCR | Нет | Нет | Оригинальный скан |
Для архивов и бухгалтерских документов безопаснее первый режим — оригинал остаётся в неприкосновенности, что важно при проверках. Редактируемый режим оправдан, когда нужно внести правки в текст, но будьте готовы к смещению вёрстки: шрифты оригинала заменяются системными.
Пакетная обработка нескольких файлов
Когда распознать нужно не один документ, а целую папку сканов, в диалоге «Распознать текст» выберите вариант «В нескольких файлах». Acrobat предложит добавить документы списком и указать папку для сохранения результатов — ручное открытие каждого файла не потребуется.
Учтите, что обработка большого массива занимает заметное время и нагружает компьютер. Запускайте пакетное распознавание, когда машина свободна, и не закрывайте Acrobat до завершения очереди.
Что делать, если кнопка OCR неактивна
Функция распознавания доступна только в платных версиях Acrobat Standard и Pro. В бесплатном Acrobat Reader кнопка OCR отсутствует — бесплатная программа умеет лишь просматривать уже распознанные документы и пользоваться текстовым слоем, созданным ранее. Также проверьте, не защищён ли PDF паролем: на защищённых файлах часть операций блокируется.
Типичные проблемы и их решения
Если после OCR поиск по-прежнему не работает, проверьте, что распознавание действительно завершилось — на больших файлах процесс легко прервать случайно. Откройте документ заново и попробуйте выделить фрагмент текста мышью: не выделяется — значит, текстового слоя нет.
- ❌ «Крякозябры» вместо кириллицы — неверно выбран язык OCR; повторите распознавание с русским языком.
- 🐌 Очень медленная обработка — слишком высокое разрешение сканов; попробуйте уменьшить размер изображений.
- 📉 Много ошибок в словах — низкое качество исходника; пересканируйте с большим разрешением и контрастом.
- 🔒 Инструмент недоступен — файл защищён паролем или у вас Reader вместо Pro.
Отдельный случай — документы с рукописным текстом. Классический OCR в Acrobat ориентирован на печатные символы, и качество распознавания рукописей непредсказуемо: многое зависит от почерка. Гарантировать результат здесь нельзя, поэтому важные рукописные записи лучше перепроверять вручную.
Частые вопросы
Можно ли распознать текст в бесплатном Acrobat Reader?
Нет, функция OCR доступна только в платных версиях — Acrobat Standard и Acrobat Pro. Reader умеет искать и копировать текст в документах, где распознавание уже выполнено, но создать текстовый слой самостоятельно не может.
Почему после распознавания текст копируется с ошибками?
Текстовый слой — это результат автоматического анализа, и он не всегда совпадает с изображением на 100%. Причины обычно в низком качестве скана, неверно выбранном языке или нестандартном шрифте. Используйте режим «Исправить распознанный текст» для ручной коррекции важных фрагментов.
Изменится ли внешний вид документа после OCR?
В режиме «Текст и изображения с возможностью поиска» — нет: картинка остаётся оригинальной, текст добавляется скрытым слоем. В режиме «Редактируемый текст и изображения» внешний вид может измениться, так как фрагменты скана заменяются настоящим текстом с системными шрифтами.
Как распознать только часть страниц документа?
В диалоге «Распознать текст» выберите обработку текущего файла и укажите диапазон страниц вместо варианта «Все страницы». Это полезно, когда OCR нужен лишь для отдельных разделов большого документа.
Распознаёт ли Acrobat рукописный текст?
Acrobat ориентирован на печатный текст. Рукописные записи могут распознаваться частично и с большим числом ошибок — всё зависит от разборчивости почерка. Для важных рукописных документов автоматическому результату доверять не стоит.