Commencez par un numérisage lisible

Captez du texte imprimé avec un éclairage uniforme, un cadrage complet et le moins de flou possible. Faites pivoter le numérisage pour le rendre lisible. Un pli foncé ou un reflet peut masquer des lettres avant même le début de l’OCR. Si l’image source est de mauvaise qualité, la reprendre est souvent plus utile que d’essayer de corriger le texte extrait après coup.

Lancez la reconnaissance de texte

Les fonctionnalités publiées de l’app comprennent l’OCR pour extraire le texte de documents et l’exportation TXT. Utilisez le flux d’extraction de texte pour le numérisage dont vous avez besoin. Une image PDF et le texte extrait sont deux résultats différents : conservez le numérisage original quand l’apparence ou la mise en page du document compte.

Relisez avant de réutiliser

Comparez le texte extrait à la source, surtout les noms, les dates, les points décimaux et les numéros de référence. L’OCR peut confondre des lettres et des chiffres semblables, et elle peut ne pas conserver les colonnes ou les tableaux complexes. Corrigez les erreurs avant de coller le texte dans un autre document. Ne présumez jamais que la reconnaissance a vérifié le contenu de l’original.