เริ่มจากการสแกนที่อ่านได้ชัด
ถ่ายภาพข้อความที่พิมพ์ด้วยแสงสม่ำเสมอ ครอปให้ครบ และเบลอน้อยที่สุดเท่าที่จะทำได้ หมุนภาพสแกนให้อยู่ในแนวที่อ่านง่าย รอยพับสีเข้มหรือเงาสะท้อนอาจบดบังตัวอักษรก่อนที่ OCR จะเริ่มทำงานด้วยซ้ำ หากภาพต้นฉบับคุณภาพไม่ดี การถ่ายใหม่มักมีประโยชน์กว่าการพยายามแก้ไขข้อความที่ดึงออกมาทีหลัง
เรียกใช้การรู้จำข้อความ
ฟีเจอร์ที่ประกาศของแอประบุว่า OCR สำหรับดึงข้อความจากเอกสาร และส่งออกเป็น TXT ใช้เวิร์กโฟลว์ดึงข้อความสำหรับการสแกนที่คุณต้องการ ไฟล์ PDF แบบรูปภาพและข้อความที่ดึงออกมาเป็นผลลัพธ์คนละแบบ: เก็บการสแกนต้นฉบับไว้เมื่อรูปลักษณ์หรือเลย์เอาต์ของเอกสารมีความสำคัญ
ตรวจทานก่อนนำไปใช้ต่อ
เปรียบเทียบข้อความที่ดึงออกมากับต้นฉบับ โดยเฉพาะชื่อ วันที่ จุดทศนิยม และหมายเลขอ้างอิง OCR อาจสับสนตัวอักษรและตัวเลขที่คล้ายกัน และอาจไม่คงคอลัมน์หรือตารางที่ซับซ้อนไว้ แก้ไขข้อผิดพลาดก่อนวางข้อความลงในเอกสารอื่น อย่าคิดไปเองว่าการรู้จำได้ตรวจสอบความถูกต้องของเนื้อหาในต้นฉบับแล้ว
แหล่งที่มา: Scan Documents to PDF l by TSP · เวอร์ชัน 2.0.1