====================================================================== 📘 TITLE: 🔍 ГАЙД: РАСПОЗНАВАНИЕ ТЕКСТА (OCR) В ПОИСКОВЫЙ PDF 🔍 | АВТОВЫДАЧА 📂 CATEGORY: Adobe Acrobat 📄 FILENAME: gayd_raspoznavanie_teksta_ocr_so_skanov_v_poiskovyy_pdf_avtovydac_guide.txt ====================================================================== 🔍 ГАЙД: ОЦИФРОВКА, ВЫРАВНИВАНИЕ И ОПТИЧЕСКОЕ РАСПОЗНАВАНИЕ ТЕКСТА (OCR) В ACROBAT PRO 🔍 🔹 ВВЕДЕНИЕ И ПРИНЦИПЫ SEARCHABLE PDF: Обычный скан документа — это плоская растровая картинка. В ней невозможно скопировать цитату, перевести текст через переводчик или найти нужное слово через поиск `Ctrl + F`. Технология OCR (Optical Character Recognition) в Acrobat Pro генерирует под растровым сканом невидимый слой реального векторного текста (Invisible Searchable Text Layer), синхронизированный с координатами каждой буквы на скане. 🔹 ШАГ 1: ПРЕДВАРИТЕЛЬНАЯ ОБРАБОТКА И УЛУЧШЕНИЕ СКАНИРОВАННОГО ЛИСТА 1. Откройте скан в Acrobat Pro -> выберите `Все инструменты` -> `Сканирование и распознавание (Scan & OCR)`. 2. Нажмите кнопку `Улучшить (Enhance)` -> `Сканированный документ (Scanned Document)`: • `Устранение перекоса (Deskew)`: автоматически поворачивает криво отсканированные страницы ровно по горизонтали. • `Удаление теней от корешка книги и фонового шума бумаги (Background Removal)`. • `Фильтр резкости текста (Text Sharpening)`. 🔹 ШАГ 2: НАСТРОЙКА И ЗАПУСК ДВИЖКА OCR 1. В панели `Scan & OCR` нажмите `Распознать текст (Recognize Text)` -> `В этом файле (In This File)`. 2. Нажмите значок шестеренки `Настройки (Settings)`: • `Язык документа (Language)`: выберите `Русский` и добавьте `Английский` (если в документе встречаются латинские термины). • `Формат вывода (Output)`: - `Searchable Image (Изображение с возможностью поиска)` — сохраняет аутентичный вид старинного скана со скрытым текстовым слоем под ним (эталон для архивов!). - `Editable Text and Images (Редактируемый текст)` — преобразует скан в чистый векторный документ с удалением растрового фона. • `Понижение разрешения (Downsample)`: `600 dpi` для максимального качества. 3. Нажмите синюю кнопку `Распознать текст (Recognize Text)`. 🔹 ШАГ 3: ИСПРАВЛЕНИЕ НЕУВЕРЕННО РАСПОЗНАННЫХ СЛОВ (CORRECT SUSPECTS) 1. В панели Scan & OCR нажмите `Исправить сомнительный текст (Correct Recognized Text)`. 2. Acrobat поочередно подсветит слова, где нейросеть не уверена на 100% (например, похожие символы `З` и `3`, `О` и `0`). 3. Подтвердите правильное слово нажатием `Accept` или введите верный символ вручную. 🔹 ТОНКАЯ НАСТРОЙКА И ПРЕОДОЛЕНИЕ ТИПИЧНЫХ ОШИБОК: 1. Пакетное распознавание архива из 1000 сканов: Выберите `Recognize Text` -> `В нескольких файлах (In Multiple Files)` -> добавьте папку со сканами. Программа обработает весь архив в фоновом режиме. 💡 Если у вас возникнут любые вопросы по выполнению шагов из этого гайда — напишите в чат заказа, я с радостью подскажу!