앱은 Google ML Kit을 통해 온디바이스에서 19개 언어를 번역합니다. 전체 목록: 아랍어, 중국어(간체), 체코어, 네덜란드어, 영어, 프랑스어, 독일어, 크로아티아어, 헝가리어, 이탈리아어, 일본어, 한국어, 폴란드어, 포르투갈어, 루마니아어, 러시아어, 슬로바키아어, 슬로베니아어, 스페인어. ML Kit이 새로운 온디바이스 모델을 출시하면 새 언어가 추가됩니다.
언어 선택기
선택기는 소스 및 대상 언어를 선택하는 단일 진입점이며, 카메라 페이지 또는 텍스트 번역 페이지 상단의 언어 표시줄에서 액세스합니다.
- 검색. 검색 필드에 입력하여 영어 이름 또는 언어 코드로 필터링합니다. 입력하는 동안 목록이 업데이트됩니다.
- 최근 사용. 상단 섹션은 최근 여러 번역에서 사용한 언어를 보여줍니다. 선택하면 자동으로 맨 위로 이동합니다.
- 자동 감지(소스만). 소스 선택기의 첫 번째 옵션으로 나타납니다. 선택하면 앱이 캡처당 소스 언어를 추측합니다(아래 참조).
- 모든 언어. 최근 사용 섹션 아래에 19개 지원 언어의 전체 목록과 해당 국가 국기가 있습니다.
소스와 대상 선택기는 독립적으로 열 수 있습니다. 대상과 동일한 소스를 선택하면 선택기에서 이 점이 강조 표시되어 우발적인 동일 번역을 방지합니다.
소스 자동 감지
소스가 자동 감지로 설정되면 앱은 번역당 특정 ML Kit 소스 언어를 선택해야 합니다. 두 가지 전략이 사용됩니다.
- 사진 캡처의 경우. OCR 엔진의 블록별 언어 힌트가 집계됩니다. 블록 전체의 다수 언어가 ML Kit 소스가 됩니다. 단일 언어 페이지는 깔끔하게 해결됩니다. 혼합 스크립트 페이지는 기본값으로 폴백합니다.
- 텍스트 번역의 경우. Dart 레이어 휴리스틱이 스크립트 클래스별로 문자를 계산합니다. 한자 → 간체 중국어, 가나 → 일본어, 한글 → 한국어, 라틴 문자 → 영어, 키릴 문자 → 러시아어, 아랍어 문자 → 아랍어 등. 비어 있거나 공백만 있는 입력은 영어로 기본 설정됩니다.
자동 감지는 조용히 실패하지 않습니다. 번역이 실행될 때 페이지에는 항상 특정 ML Kit 소스 언어가 있습니다.
왜 19개이고 그 이상이 아닌가
이 개수는 ML Kit이 온디바이스 모델로 게시하는 언어에 의해 제한됩니다. 이 목록 이외의 언어는 ML Kit으로 온디바이스에서 번역할 수 없습니다. 목록은 큐레이션됩니다. 각 항목에는 10~50MB의 다운로드 가능한 모델이 있습니다. 선택기는 유효한 BCP 47 코드인 경우에도 ML Kit이 지원하지 않는 언어를 제외합니다.
UI의 i18n
앱 자체의 인터페이스(메뉴, 설정, 오류 메시지)는 10개 언어로 번역됩니다: 아랍어, 영어, 독일어, 한국어, 프랑스어, 일본어, 러시아어, 스페인어, 베트남어 및 중국어(간체). 번역 언어는 여러 일반 쌍(en ↔ ja, en ↔ zh, en ↔ es, en ↔ fr)에 대해 i18n 세트의 상위 집합입니다.