온디바이스 OCR: 모든 스캔 페이지에서 검색 가능한 텍스트

Last updated: 2026-09-02

OCR(광학 문자 인식)은 스캔한 페이지를 선택, 복사, 검색할 수 있는 텍스트로 변환합니다. Paper Scan은 Apple과 Google의 온디바이스 ML 키트를 사용해 OCR을 완전히 기기에서만 실행하므로, 인식을 위해 스캔 내용이 외부 서버로 전송되지 않습니다. 인식된 페이지는 로컬 라이브러리에 인덱싱되어 저장되는 즉시 검색 대상이 됩니다.

OCR이 가능하게 하는 것

페이지가 인식되면 다음이 가능합니다:

온디바이스 처리가 중요한 이유

정확도는 서버 기반 OCR 서비스와 비슷하며, 차이는 계산이 어디서 실행되는가입니다.

정확한 인식을 위한 모범 사례

OCR 정확도는 주로 입력 품질에 달려 있습니다. 중요도 순으로 세 가지:

  1. 조명. 창에서 들어오는 균일한 간접광이 머리 위 단일 스포트라이트보다 낫습니다. 페이지를 가로지르는 그림자가 오독의 가장 흔한 원인입니다.
  2. 초점. 자동 초점이 잘못된 피사체를 선택하면 캡처 전에 텍스트 중앙을 탭하세요. 흐릿한 스캔은 거의 쓸 수 없습니다.
  3. 필터 선택. 흑백은 인쇄된 양식에 대해 가장 깨끗한 텍스트를 제공합니다. 매직 컬러는 잉크가 바래거나 종이가 누렇게 변했을 때 권장됩니다. 자동은 대부분의 일상 사례를 다룹니다.
  4. 평평한 페이지. 제본 쪽으로 휜 페이지는 안쪽 여백 근처의 글자를 잃습니다. 가능하면 다른 손으로 페이지를 평평하게 누르세요.
  5. 언어 힌트. 단일 언어 페이지의 경우 OCR 언어를 명시적으로 설정하세요. 혼합 스크립트 페이지는 힌트 없이 한 번에 처리됩니다.

정확도 한계

OCR은 인쇄된 텍스트(95%+ 정확도)에 대해서는 잘 작동하지만, 손글씨 흘림체, 매우 작은 글꼴, 양식화된 장식 글꼴, 광택 잡지 반사, 잉크가 물리적으로 바랜 오래된 영수증에서는 신뢰도가 떨어집니다. 원본 이미지는 모든 경우에 사용 가능합니다: 중요한 페이지에서 OCR이 실패해도 스캔 자체를 읽을 수 있습니다.

무료 등급에는 일상 영수증, 명함, 가끔 챕터에 충분한 일일 OCR 허용량이 포함됩니다. Pro는 일일 한도를 없애고 한 번의 작업으로 전체 폴더에 OCR을 실행하는 기능을 추가합니다.

온디바이스 엔진은 라틴 문자(영어, 프랑스어, 독일어, 스페인어, 포르투갈어, 이탈리아어 등), 중국어(간체 및 번체), 일본어, 한국어, 대부분의 유럽 문자를 지원합니다. 혼합 스크립트 페이지는 단일 인식 패스로 처리됩니다.