OCR (การรู้จำตัวอักษรด้วยแสง) แปลงหน้าที่สแกนเป็นข้อความที่สามารถเลือก คัดลอก และค้นหาได้ Paper Scan รัน OCR ทั้งหมดบนอุปกรณ์โดยใช้ชุด ML ของ Apple และ Google ดังนั้นเนื้อหาที่สแกนจะไม่ถูกส่งไปยังเซิร์ฟเวอร์ภายนอกเพื่อทำการรู้จำ หน้าที่รู้จำแล้วจะถูกจัดทำดัชนีในไลบรารีในเครื่องและสามารถค้นหาได้ทันทีที่บันทึก
สิ่งที่ OCR ปลดล็อก
เมื่อหน้าถูกรู้จำแล้ว:
- คัดลอกข้อความจากการสแกน กดค้างที่คำใดก็ได้เพื่อเปิดเลเยอร์การเลือกที่ครอบคลุมทั้งหน้า ข้อความที่เลือกสามารถวางลงในแอปอื่นใดก็ได้
- ค้นหาภายในการสแกน แถบค้นหาที่ด้านบนของรายการเอกสารจะค้นหาข้อความที่รู้จำแล้วของทุกหน้า ไม่ใช่แค่ชื่อเรื่องและแท็ก สามารถค้นหาหมายเลขโทรศัพท์ ชื่อ หมายเลขใบแจ้งหนี้ และที่อยู่ทั่วทั้งไลบรารี
- อ้างอิงและอ้างอิง ใบเสร็จที่สแกน สัญญา บันทึกด้วยลายมือ และการจับกระดานไวท์บอร์ดกลายเป็นข้อความที่อ้างอิงได้ซึ่งสามารถอ้างอิงในภายหลัง
เหตุใดการประมวลผลบนอุปกรณ์จึงสำคัญ
- ความเป็นส่วนตัว เนื้อหาที่สแกนจะไม่ออกจากอุปกรณ์เพื่อทำการรู้จำ สิ่งนี้เกี่ยวข้องกับใบแจ้งหนี้ สัญญา แบบฟอร์มทางการแพทย์ และเอกสารใดๆ ที่มีข้อมูลส่วนบุคคล
- ความหน่วง ไม่มีการเดินทางไปกลับของเครือข่าย บน iPhone รุ่นล่าสุดและอุปกรณ์ Android ระดับเรือธง OCR สำหรับหน้ามาตรฐานมักจะเสร็จสิ้นภายในเวลาน้อยกว่าหนึ่งวินาที
- ความพร้อมใช้งานออฟไลน์ OCR ทำงานบนเครื่องบิน ในชั้นใต้ดิน และในภูมิภาคที่ไม่มีความครอบคลุมของเครือข่าย ไม่จำเป็นต้องเชื่อมต่อ
ความแม่นยำเทียบเท่ากับบริการ OCR ที่ใช้เซิร์ฟเวอร์ ข้อแตกต่างคือการคำนวณทำงานที่ไหน
แนวปฏิบัติที่ดีที่สุดสำหรับการรู้จำที่แม่นยำ
ความแม่นยำของ OCR ขึ้นอยู่กับคุณภาพของอินพุตเป็นหลัก สามปัจจัยตามลำดับความสำคัญ:
- แสงสว่าง แสงทางอ้อมที่สม่ำเสมอจากหน้าต่างทำงานได้ดีกว่าสปอตไลท์เดี่ยวบนเพดาน เงาที่ข้ามหน้าเป็นสาเหตุที่พบบ่อยที่สุดของการอ่านตัวอักษรผิด
- โฟกัส หากออโต้โฟกัสเลือกวัตถุที่ไม่ถูกต้อง ให้แตะที่ศูนย์กลางของข้อความก่อนจับภาพ การสแกนที่เบลอมักจะเป็นการสแกนที่ใช้ไม่ได้
- การเลือกตัวกรอง ขาวดำให้ข้อความที่สะอาดที่สุดสำหรับแบบฟอร์มที่พิมพ์ แนะนำสีวิเศษเมื่อหมึกซีดจางหรือกระดาษเหลือง อัตโนมัติจัดการกรณีในชีวิตประจำวันส่วนใหญ่
- หน้าเรียบ หน้าที่โค้งเข้าหาสันจะสูญเสียตัวอักษรใกล้ร่อง กดหน้าให้เรียบด้วยมืออีกข้างเมื่อเป็นไปได้
- คำแนะนำภาษา ตั้งค่าภาษา OCR อย่างชัดเจนสำหรับหน้าภาษาเดียว หน้าสคริปต์ผสมทำงานในการส่งผ่านครั้งเดียวโดยไม่ต้องมีคำแนะนำ
ข้อจำกัดของความแม่นยำ
OCR ทำงานได้ดีกับข้อความที่พิมพ์ (ความแม่นยำ 95%+) แต่มีความน่าเชื่อถือน้อยกว่าสำหรับลายมือเขียน ฟอนต์ขนาดเล็กมาก ฟอนต์ตกแต่งสไตล์ การสะท้อนของนิตยสารมันวาว และใบเสร็จเก่าที่หมึกซีดจางทางกายภาพ ภาพต้นฉบับยังคงมีอยู่ในทุกกรณี: หาก OCR ล้มเหลวในหน้าที่สำคัญ การสแกนเองยังคงสามารถอ่านได้
ระดับฟรีรวมค่าเผื่อ OCR รายวันที่เพียงพอสำหรับใบเสร็จในชีวิตประจำวัน นามบัตร และบทหนังสือเป็นครั้งคราว Pro จะลบขีดจำกัดรายวันและเพิ่มความสามารถในการเรียกใช้ OCR กับโฟลเดอร์ทั้งหมดในการทำงานครั้งเดียว
เครื่องมือบนอุปกรณ์รองรับสคริปต์ละติน (อังกฤษ ฝรั่งเศส เยอรมัน สเปน โปรตุเกส อิตาลี และอื่นๆ) จีน (ตัวย่อและตัวเต็ม) ญี่ปุ่น เกาหลี และสคริปต์ยุโรปส่วนใหญ่ หน้าสคริปต์ผสมได้รับการจัดการในการส่งผ่านการรู้จำครั้งเดียว