OCR (Optical Character Recognition) — распознавание текста с картинки. Если PDF — это скан, выделить текст обычным способом нельзя: каждая страница для компьютера — это просто фотография. OCR превращает её в редактируемый текст.
Когда нужен OCR
- Документ отсканирован, нужно скопировать пару абзацев
- Хотите искать по содержимому архива PDF
- Нужно конвертировать скан в Word для редактирования
- Готовите электронную копию для подачи в инстанции (некоторые требуют распознанный PDF)
Лучшие инструменты OCR
Google Drive (бесплатно)
Загрузите PDF или JPG в Drive → правый клик → «Открыть в Google Документы». Drive автоматически распознает текст и создаст редактируемую копию. Поддерживает русский язык, качество отличное.
ABBYY FineReader (платно)
Эталон в индустрии. Поддерживает 200+ языков, распознаёт сложные таблицы, формулы. Free trial 30 дней.
Tesseract (бесплатно, open-source)
Командная строка: tesseract scan.png output -l rus. Качество хорошее, требует подготовки изображения.
Adobe Acrobat Pro
Инструменты → Распознавание текста → выбрать страницы. Создаёт «hybrid» PDF — изначальная картинка + невидимый текстовый слой поверх.
Как улучшить качество распознавания
- Скан должен быть 300 dpi минимум (лучше 600 для мелкого шрифта)
- Контрастный, без перекосов — выровняйте перед OCR
- Без бликов и теней (важно для фото с телефона)
- Чёрно-белая копия часто распознаётся лучше цветной
Когда OCR не помогает
Рукописный текст распознаётся слабо — даже современные нейросетевые OCR-движки делают много ошибок. Печатный текст с обычного скана — около 99% точности.
Откройте бесплатный редактор и подпишите документ за 30 секунд.
Готовы попробовать?
Откройте бесплатный редактор и подпишите свой первый документ за 30 секунд. Без установок и регистрации в полном объёме.
Открыть редактор