結果頁將翻譯渲染回原圖之上,每個 OCR 區塊一個疊加圖層。每個區塊的翻譯出現在 OCR 引擎偵測到來源文字的精確矩形中。疊加圖層支援透明度滑桿,因此使用者可以在不離開頁面的情況下並排比較原始文字和翻譯。
疊加圖層如何運作
- 按區塊翻譯。 每個偵測到的 TextBlock 作為獨立的翻譯任務傳送到 ML Kit。翻譯會隨著它們完成而流入疊加圖層;使用者會看到區塊依照引擎完成的順序「變成」已翻譯。
- 按矩形定位。 翻譯後的文字會換行並定位以適應來源區塊的邊界框。如果區塊較窄,翻譯會換行成多行並可能略微超出來源矩形;引擎優先考慮可讀性而非嚴格包含。
- 點擊聚焦。 點擊翻譯區塊會開啟一個底部表單,捲動到「完整翻譯」檢視中的同一區塊,因此使用者可以在不縮放照片的情況下閱讀較長的翻譯。
- 可調透明度。 滑桿控制疊加圖層的不透明度。滑動到完全透明以查看原始照片,完全不透明以閱讀翻譯。
結果頁結構
- 頂部列。 關閉按鈕。沒有其他控制項——結果頁刻意保持極簡。
- 主區域。 全螢幕的原始照片,疊加圖層渲染在其上方。InteractiveViewer 允許縮放和平移以檢查小文字。
- 底部表單。 三種狀態:摺疊(預設)、中等(約半個螢幕)、展開(大部分螢幕)。摺疊狀態顯示一個小把手和摘要;中等狀態將每區塊翻譯顯示為卡片;展開狀態全寬顯示所有區塊翻譯。
- 表單中的兩個分頁。 「區塊」分頁依 OCR 區塊分組顯示翻譯,「完整」分頁顯示合併的完整段落翻譯。
為何按區塊翻譯
- 混合字型。 包含英文標題和日文說明的頁面受益於按區塊的來源語言提示。區塊的位置和字型類別會通知引擎使用哪個來源模型。
- 失敗隔離。 單一區塊翻譯失敗不會阻塞頁面的其餘部分。疊加圖層使用一個小警告徽章標記失敗的區塊,以便使用者知道哪些需要手動關注。
- 版面保留。 閱讀來源語言的使用者可以透過眼睛定位對應的翻譯——對於選單、標牌和標籤等空間關係很重要的場景很有用。
編輯行為
疊加圖層渲染在照片之上,而不是烘焙進去。儲存到歷史紀錄會儲存原始照片和按區塊翻譯記錄。開啟儲存的條目會精確再現疊加圖層;不支援編輯照片。