Comenceu amb un escaneig llegible

Captureu text imprès amb una il·luminació uniforme, un retall complet i tan poc desenfocament com sigui possible. Gireu l’escaneig fins a obtenir una orientació llegible. Un plec fosc o un reflex poden amagar lletres abans que l’OCR ni tan sols comenci. Si la imatge d’origen és deficient, tornar-la a capturar sovint és més útil que intentar arreglar el text extret després.

Executeu el reconeixement de text

Les funcions publicades de l’app inclouen OCR per extreure text de documents i exportació TXT. Feu servir el flux de treball d’extracció de text per a l’escaneig que necessiteu. Una imatge en PDF i el text extret són resultats diferents: conserveu l’escaneig original quan l’aparença o la maquetació del document siguin importants.

Revisió abans de tornar-ho a utilitzar

Compareu el text extret amb l’original, especialment noms, dates, punts decimals i números de referència. L’OCR pot confondre lletres i dígits semblants, i potser no preserva columnes ni taules complexes. Corregiu els errors abans d’enganxar el text en un altre document. No suposeu mai que el reconeixement ha verificat el contingut de l’original.