離線翻譯如何在你的 iPhone 上運作

Last updated: 2026-09-03

離線翻譯如何在你的 iPhone 上運作

應用程式的翻譯路徑完全在裝置本機執行。沒有照片、沒有 OCR 結果、沒有任何翻譯請求會離開 iPhone。本文解釋「裝置本機」的真正含義、模型存在的位置以及在本機執行翻譯所帶來的權衡。

在裝置上執行的部分

相機翻譯有三個獨立的工作在手機上完成:

  1. OCR。 一個分叉的 vision_text_recognition 套件在本機執行文字辨識。它支援拉丁文、中文(簡體和繁體)、日文和韓文字型。每個識別到的文字區塊都帶有自己的邊界框和識別到的文字。
  2. 翻譯。 Google ML Kit 的裝置本機翻譯引擎將 OCR 輸出作為輸入並產生翻譯文字。引擎作為可下載的語言模型按語言對綁定;應用程式按需下載模型並將其快取在磁碟上。
  3. 渲染。 結果頁將每個翻譯後的區塊繪製回原始照片上,使用 OCR 引擎返回的邊界框。無需往返伺服器即可渲染疊加層 — 影像、來源區塊和翻譯都存在於裝置的記憶體中。

為什麼這很重要

模型存在的位置

ML Kit 為 19 種語言發佈裝置本機翻譯模型。每個模型大約 10–50 MB。當你選擇來源或目標語言時,應用程式在首次使用時將對應模型下載到應用程式的本機沙盒中。該模型在應用程式重新啟動之間持續存在;刪除它會立即回收儲存。

支援的語言完整列表:阿拉伯語、中文(簡體)、捷克語、荷蘭語、英語、法語、德語、克羅埃西亞語、匈牙利語、義大利語、日語、韓語、波蘭語、葡萄牙語、羅馬尼亞語、俄語、斯洛伐克語、斯洛維尼亞語和西班牙語。

上傳的內容(以及不上傳的內容)

本機執行的權衡

這對你意味著什麼

如果你曾經因為照片最終會出現在別人的伺服器上而猶豫是否要拍攝敏感文件,那麼這種猶豫就是該應用程式存在的原因。管道的每個部分都在本機執行,應用程式的資料模型是圍繞「除非使用者明確選擇共享結果,否則沒有任何東西離開裝置」的前提設計的。