OCR(광학 문자 인식)은 스캔한 페이지를 선택, 복사, 검색할 수 있는 텍스트로 변환합니다. Paper Scan은 Apple과 Google의 온디바이스 ML 키트를 사용해 OCR을 완전히 기기에서만 실행하므로, 인식을 위해 스캔 내용이 외부 서버로 전송되지 않습니다. 인식된 페이지는 로컬 라이브러리에 인덱싱되어 저장되는 즉시 검색 대상이 됩니다.
OCR이 가능하게 하는 것
페이지가 인식되면 다음이 가능합니다:
- 스캔에서 텍스트 복사. 아무 단어나 길게 누르면 페이지 전체를 덮는 선택 오버레이가 나타납니다. 선택한 텍스트는 다른 앱에 붙여넣을 수 있습니다.
- 스캔 내부 검색. 문서 목록 상단의 검색 창은 제목과 태그는 물론이고 모든 페이지의 인식된 텍스트를 조회합니다. 전화번호, 이름, 청구 번호, 주소를 라이브러리 전체에서 찾을 수 있습니다.
- 인용 및 참조. 스캔한 영수증, 계약서, 손글씨 메모, 화이트보드 캡처는 모두 나중에 참조 가능한 인용 가능한 텍스트가 됩니다.
온디바이스 처리가 중요한 이유
- 프라이버시. 스캔 내용이 기기를 떠나지 않습니다. 인보이스, 계약서, 의료 양식, 개인 데이터를 포함한 모든 문서에 관련됩니다.
- 지연 시간. 네트워크 왕복이 없습니다. 최신 iPhone과 플래그십 Android에서 표준 1페이지 OCR은 보통 1초 이내에 완료됩니다.
- 오프라인 사용 가능. 기내, 지하실, 네트워크가 없는 지역에서도 OCR이 작동합니다. 연결이 필요 없습니다.
정확도는 서버 기반 OCR 서비스와 비슷하며, 차이는 계산이 어디서 실행되는가입니다.
정확한 인식을 위한 모범 사례
OCR 정확도는 주로 입력 품질에 달려 있습니다. 중요도 순으로 세 가지:
- 조명. 창에서 들어오는 균일한 간접광이 머리 위 단일 스포트라이트보다 낫습니다. 페이지를 가로지르는 그림자가 오독의 가장 흔한 원인입니다.
- 초점. 자동 초점이 잘못된 피사체를 선택하면 캡처 전에 텍스트 중앙을 탭하세요. 흐릿한 스캔은 거의 쓸 수 없습니다.
- 필터 선택. 흑백은 인쇄된 양식에 대해 가장 깨끗한 텍스트를 제공합니다. 매직 컬러는 잉크가 바래거나 종이가 누렇게 변했을 때 권장됩니다. 자동은 대부분의 일상 사례를 다룹니다.
- 평평한 페이지. 제본 쪽으로 휜 페이지는 안쪽 여백 근처의 글자를 잃습니다. 가능하면 다른 손으로 페이지를 평평하게 누르세요.
- 언어 힌트. 단일 언어 페이지의 경우 OCR 언어를 명시적으로 설정하세요. 혼합 스크립트 페이지는 힌트 없이 한 번에 처리됩니다.
정확도 한계
OCR은 인쇄된 텍스트(95%+ 정확도)에 대해서는 잘 작동하지만, 손글씨 흘림체, 매우 작은 글꼴, 양식화된 장식 글꼴, 광택 잡지 반사, 잉크가 물리적으로 바랜 오래된 영수증에서는 신뢰도가 떨어집니다. 원본 이미지는 모든 경우에 사용 가능합니다: 중요한 페이지에서 OCR이 실패해도 스캔 자체를 읽을 수 있습니다.
무료 등급에는 일상 영수증, 명함, 가끔 챕터에 충분한 일일 OCR 허용량이 포함됩니다. Pro는 일일 한도를 없애고 한 번의 작업으로 전체 폴더에 OCR을 실행하는 기능을 추가합니다.
온디바이스 엔진은 라틴 문자(영어, 프랑스어, 독일어, 스페인어, 포르투갈어, 이탈리아어 등), 중국어(간체 및 번체), 일본어, 한국어, 대부분의 유럽 문자를 지원합니다. 혼합 스크립트 페이지는 단일 인식 패스로 처리됩니다.