واضح اسکین سے آغاز کریں
چھپے ہوئے متن کی تصویر یکساں روشنی میں لیں، کنارے اس طرح تراشیں کہ پورا متن شامل رہے، اور دھندلاہٹ کم سے کم رکھیں۔ اسکین کو گھما کر پڑھنے کے قابل رخ میں لائیں۔ گہری سلوٹ یا روشنی کا عکس OCR شروع ہونے سے پہلے ہی حروف چھپا سکتا ہے۔ اگر اصل تصویر ناقص ہو تو بعد میں نکالے گئے متن کو درست کرنے کی کوشش کے بجائے دوبارہ تصویر لینا اکثر زیادہ مفید ہوتا ہے۔
متن کی شناخت کا عمل چلائیں
ایپ کی شائع شدہ خصوصیات میں دستاویزات سے متن نکالنے کے لیے OCR اور TXT کی صورت میں برآمد کرنا شامل ہے۔ مطلوبہ اسکین کے لیے متن نکالنے کا طریقۂ کار استعمال کریں۔ PDF میں موجود تصویر اور نکالا گیا متن الگ نتائج ہیں: جب دستاویز کی ظاہری شکل یا ترتیب اہم ہو تو اصل اسکین محفوظ رکھیں۔
دوبارہ استعمال سے پہلے متن کی تصحیح کریں
نکالے گئے متن کا اصل سے موازنہ کریں، خاص طور پر ناموں، تاریخوں، اعشاری نقطوں اور حوالہ نمبروں کا۔ OCR ملتے جلتے حروف اور ہندسوں میں غلطی کر سکتا ہے، اور ممکن ہے کہ کالم یا پیچیدہ جدولیں برقرار نہ رکھ سکے۔ متن کو دوسری دستاویز میں چسپاں کرنے سے پہلے غلطیاں درست کریں۔ کبھی یہ فرض نہ کریں کہ متن کی شناخت نے اصل مواد کی تصدیق بھی کر دی ہے۔