Начните с читаемого скана
Снимайте печатный текст при равномерном освещении, с полным кадрированием и как можно меньшим размытием. Поверните скан в удобную для чтения ориентацию. Тёмный сгиб или блик могут скрыть буквы ещё до начала OCR. Если исходное изображение низкого качества, переснять его часто полезнее, чем пытаться исправить извлечённый текст позже.
Запустить распознавание текста
В опубликованные функции приложения входят OCR для извлечения текста из документов и экспорт TXT. Используйте рабочий процесс извлечения текста для нужного скана. Изображение PDF и извлечённый текст — это разные результаты: сохраняйте исходный скан, когда важны внешний вид или макет документа.
Проверьте перед повторным использованием
Сравните извлечённый текст с исходником, особенно имена, даты, десятичные знаки и номера ссылок. OCR может путать похожие буквы и цифры, а также не сохранять столбцы или сложные таблицы. Исправьте ошибки, прежде чем вставлять текст в другой документ. Никогда не считайте, что распознавание проверило содержимое исходного документа.