साफ़ पढ़ने योग्य स्कैन से शुरू करें

छपे हुए पाठ की तस्वीर समान रोशनी में लें, पूरा हिस्सा रखें और धुंधलापन जितना हो सके कम रखें। स्कैन को घुमाकर पढ़ने योग्य दिशा में करें। गहरी सिलवट या प्रकाश का प्रतिबिंब OCR शुरू होने से पहले ही अक्षरों को छिपा सकता है। अगर मूल तस्वीर खराब है, तो बाद में निकाले गए पाठ को ठीक करने की कोशिश करने के बजाय उसे फिर से लेना अक्सर अधिक उपयोगी होता है।

पाठ पहचान की प्रक्रिया चलाएँ

ऐप की प्रकाशित सुविधाओं में दस्तावेज़ों से पाठ निकालने के लिए OCR और TXT निर्यात शामिल हैं। जिस स्कैन की आपको ज़रूरत है, उसके लिए पाठ निकालने की प्रक्रिया का इस्तेमाल करें। PDF में मौजूद तस्वीर और निकाला गया पाठ अलग-अलग परिणाम हैं: जब दस्तावेज़ का रूप या पृष्ठों की बनावट मायने रखती हो, तो मूल स्कैन संभालकर रखें।

दोबारा इस्तेमाल करने से पहले पाठ जाँचें

निकाले गए पाठ की तुलना मूल स्रोत से करें, खास तौर पर नाम, तारीखें, दशमलव बिंदु और संदर्भ संख्याएँ जाँचें। OCR मिलते-जुलते अक्षरों और अंकों में भ्रम कर सकता है और हो सकता है कि वह स्तंभों या जटिल तालिकाओं को बरकरार न रखे। पाठ को किसी दूसरे दस्तावेज़ में चिपकाने से पहले गलतियाँ सुधारें। कभी यह न मानें कि पाठ पहचान की प्रक्रिया ने मूल सामग्री की पुष्टि कर दी है।