Zacznij od czytelnego skanu

Uchwyć drukowany tekst przy równomiernym oświetleniu, pełnym kadrowaniu i możliwie najmniejszym rozmyciu. Obróć skan do czytelnej orientacji. Ciemne zagięcie lub odbicie światła może zasłonić litery jeszcze przed rozpoczęciem OCR. Jeśli obraz źródłowy jest słaby, ponowne zeskanowanie często ma większy sens niż próba poprawiania wyodrębnionego tekstu później.

Uruchom rozpoznawanie tekstu

Opublikowane funkcje aplikacji obejmują OCR do wyodrębniania tekstu z dokumentów oraz eksport TXT. Użyj przepływu wyodrębniania tekstu dla skanu, którego potrzebujesz. Obraz PDF i wyodrębniony tekst to różne wyniki: zachowaj oryginalny skan, gdy znaczenie ma wygląd lub układ dokumentu.

Sprawdź przed ponownym użyciem

Porównaj wyodrębniony tekst ze źródłem, zwłaszcza nazwy, daty, miejsca po przecinku i numery referencyjne. OCR może mylić podobne litery i cyfry, a także nie zachować kolumn ani złożonych tabel. Popraw błędy przed wklejeniem tekstu do innego dokumentu. Nigdy nie zakładaj, że rozpoznawanie zweryfikowało treść oryginału.