Как сделать отсканированный PDF доступным для поиска на Mac
«Просмотр» и «Онлайн-текст» умеют считывать текст с отсканированной страницы, но не сохраняют его в PDF, поэтому поиск и Spotlight по-прежнему видят лишь картинку. Инструмент «OCR PDF» в File Acture распознает текст на вашем Mac и встраивает его невидимым слоем, так что получается копия с поиском, которая выглядит точно как скан.
Обновлено 23 сентября 2026 г.5 мин чтенияПроверено в File Acture 1.0.9 на macOS 26
Команда File Acture
Вы отсканировали пачку чеков или подписанный договор, а Command-F теперь ничего не находит. Так происходит потому, что сканер сохранил каждую страницу как изображение. OCR, оптическое распознавание символов, читает буквы на этом изображении и сохраняет их как настоящий текст, так что файл становится доступным для поиска, а выглядит по-прежнему.
Почему в отсканированном PDF нельзя искать и копировать текст?
Искать в отсканированном PDF не получается потому, что внутри лежит фотография каждой страницы, а не сами буквы. Планшетные сканеры, приложения для сканирования на телефоне и офисные копиры обычно сохраняют страницы именно так, если только не запускают распознавание прямо при сканировании.
В итоге файл выглядит как документ, но ведет себя как фотоальбом. Command-F в «Просмотре» ничего не находит, Spotlight не может найти файл по его содержимому, номер счета не скопировать в письмо, а программам чтения с экрана нечего озвучивать.
Может ли «Просмотр» распознать текст в PDF на Mac?
«Просмотр» не умеет добавлять текстовый слой в PDF, поэтому сделать скан доступным для поиска он не может. Функция «Онлайн-текст» в macOS позволяет выделять текст внутри изображений — это удобно, когда нужно выхватить один телефон или адрес.
Загвоздка в том, что в сам файл ничего не записывается. Spotlight, другие программы и человек, которому вы отправите PDF, по-прежнему получат картинку. Для документа, в котором вы будете искать позже или который передадите кому-то еще, текст должен быть встроен в сам PDF.
Как распознать текст в PDF на Mac в File Acture
Инструмент «OCR PDF» в File Acture запускает распознавание текста Vision от Apple на каждой отсканированной странице и встраивает результат невидимым текстовым слоем поверх исходного изображения. Страница выглядит в точности как раньше, но в ней можно искать, выделять строки и копировать их.
Вы выбираете Язык документа: «Автоматическое определение» либо один из языков — английский, турецкий, немецкий, французский, испанский, итальянский, португальский, русский, китайский, японский и корейский. В поле Точность есть «Высокая точность» — вариант по умолчанию, который читает внимательнее, — и «Быстро», подходящий для длинных серий чистых печатных страниц. Страницы, в которых текст уже есть, копируются как есть, поэтому в PDF из набранных и отсканированных страниц не появится задвоенного текста.
Для PDF с паролем появляется поле Пароль, и копия с поиском снова защищается тем же паролем. Название документа, автор, тема и ключевые слова сохраняются, а к имени каждой копии добавляется «-searchable». За один запуск можно обработать несколько PDF, и ваши исходные файлы остаются без изменений.
Как проверить, что распознавание сработало?
Откройте копию с поиском и нажмите Command-F: слова, которые видны на странице, должны подсветиться на своих местах. Можно также провести по строке, чтобы выделить ее, или вставить скопированный абзац в заметку и увидеть, что именно было распознано. Spotlight индексирует текст PDF, поэтому, как только он обновит индекс, файл найдется по фразе из документа.
Как добиться лучшего распознавания на Mac
Распознавание не бывает лучше самого скана, поэтому ровные и четкие страницы дают лучший текст.
- Выберите язык. «Автоматическое определение» подходит многим документам, но выбранный язык подсказывает распознаванию, чего ждать, — особенно это важно для китайского, японского, корейского и русского.
- Сканируйте в 300 DPI. Если сканер в ваших руках, 300 DPI — хорошая настройка для текста. Существенно ниже — и мелкий шрифт превращается в размытые пятна, которые трудно прочитать.
- Сначала выровняйте страницы. Поставьте боковые страницы прямо с помощью инструмента «Повернуть страницы», а потом запускайте распознавание.
- Фотографии документов? Соберите их в один PDF с помощью «Изображения в PDF», а затем распознайте текст в получившемся файле.
- Сохраните оригинал. Копия с распознанным текстом отрисовывается заново страница за страницей, поэтому ссылки, закладки и поля форм не переносятся.
- Следите за размером файла. Распознавание добавляет текст, но не уменьшает изображения. Если копия слишком большая для отправки, пропустите ее через «Сжать PDF» — текстовый слой останется на месте.
Безопасно ли распознавать документы онлайн?
Онлайн-сервисам распознавания нужен ваш документ на их серверах, а это важно, когда речь о банковских выписках, письмах из клиники и сканах удостоверений. File Acture распознает текст на вашем Mac, поэтому страницы его не покидают, а Pro работает и без подключения к интернету, выходя в сеть лишь изредка, чтобы продлить лицензию.
В бесплатной версии — 3 запуска на каждом Mac, до 5 PDF за запуск. Для больших архивов сканов — посмотрите цены.
Как сделать отсканированный PDF доступным для поиска в File Acture
- 1
Откройте «OCR PDF»
Выберите OCR PDF в боковом меню и перетащите в окно отсканированные PDF или нажмите Выбрать файлы….
- 2
Задайте язык
В разделе Распознавание выберите Язык документа и оставьте Точность на значении Высокая точность.
- 3
Введите пароль, если он нужен
Если PDF защищен паролем, введите его в появившемся поле Пароль.
- 4
Распознайте текст
Нажмите Распознать текст. К имени каждой копии добавится «-searchable».
- 5
Проверьте результат
Откройте копию, нажмите Command-F и найдите слово, которое видно на странице.
Превращайте отсканированные PDF в файлы с поиском, на вашем Mac.
Бесплатно попробовать · macOS 14 или новее
| Способ | Сохраняет PDF с поиском | Несколько файлов за раз | Остается на вашем Mac |
|---|---|---|---|
| «Онлайн-текст» | Нет | Нет, по одному выделению | Да |
| «Просмотр» | Нет | Нет, распознавания в нем нет | Да |
| Онлайн-сервисы OCR | Да | По-разному | Нет, файл загружается на сервер |
| File Acture, «OCR PDF» | Да | Да | Да |
Вопросы
Может ли «Просмотр» сделать PDF доступным для поиска?
Нет. «Просмотр» показывает PDF и позволяет делать пометки, а «Онлайн-текст» — копировать текст с изображений, но ни то, ни другое не сохраняет текстовый слой в файл.
Меняет ли распознавание внешний вид PDF?
Нет. Распознанный текст невидим и лежит поверх исходного изображения страницы, поэтому страницы выглядят так же, а поиск и копирование работают.
Какие языки распознает File Acture?
Английский, турецкий, немецкий, французский, испанский, итальянский, португальский, русский, китайский, японский и корейский. Можно также оставить «Автоматическое определение».
Почему часть текста после распознавания пропала?
Размытый, очень мелкий или боковой текст может не распознаться. Поверните страницы прямо, при возможности отсканируйте заново с большим разрешением и оставьте «Точность» на «Высокая точность».
Можно ли распознать текст в PDF с паролем?
Да, если вы знаете пароль. Введите его в поле «Пароль», и копия с поиском будет защищена тем же паролем.
Сохраняются ли при распознавании ссылки и закладки?
Нет. Страницы перерисовываются вместе с текстовым слоем, поэтому ссылки, закладки и поля форм не переносятся. Для них держите оригинал под рукой.