Почніть із розбірливого скану
Зробіть фото друкованого тексту за рівномірного освітлення, повного кадрування та якомога меншого розмиття. Поверніть скан у зручну для читання орієнтацію. Темна складка або відблиск можуть приховати літери ще до початку OCR. Якщо вихідне зображення погане, повторно відсканувати його часто корисніше, ніж намагатися виправити витягнутий текст після цього.
Запустіть розпізнавання тексту
До опублікованих функцій застосунку входять OCR для витягування тексту з документів і експорт TXT. Використовуйте робочий процес витягування тексту для потрібного вам скану. Зображення в PDF і витягнутий текст — це різні результати: зберігайте оригінальний скан, коли важливі вигляд або макет документа.
Перевірте перед повторним використанням
Порівняйте витягнутий текст із джерелом, особливо імена, дати, десяткові крапки та посилальні номери. OCR може плутати схожі літери й цифри, а також може не зберігати стовпці чи складні таблиці. Виправте помилки, перш ніж вставляти текст в інший документ. Ніколи не вважайте, що розпізнавання підтвердило зміст оригіналу.