ブロックオーバーレイ:翻訳を写真上の元の位置にレンダリング

Last updated: 2026-09-03

結果ページは、翻訳を写真の上にブロックごとにレンダリングします。各ブロックの翻訳は、OCR エンジンがソーステキストを検出した正確な矩形に表示されます。オーバーレイは透明度スライダーをサポートしているため、ユーザーはページを離れることなく、原文と翻訳を並べて比較できます。

オーバーレイの仕組み

  1. ブロック単位の翻訳。 検出された各 TextBlock は、独立した翻訳ジョブとして ML Kit に送信されます。翻訳は完了する順にオーバーレイにストリームされ、ユーザーはブロックがエンジン の完了順に「翻訳されていく」のを見ます。
  2. 矩形による位置決め。 翻訳されたテキストはソースブロックの境界ボックスに合わせてラップおよび配置されます。ブロックが狭い場合、翻訳は複数行にラップされ、ソース矩形をわずかにオーバーフローする可能性があります。エンジンは厳密な包含よりも可読性を優先します。
  3. タップしてフォーカス。 翻訳されたブロックをタップすると、底面シートが開き、「完全翻訳」ビューの同じブロックまでスクロールするため、写真を拡大することなく長い翻訳を読むことができます。
  4. 調整可能な透明度。 スライダーがオーバーレイレイヤーの不透明度を制御します。完全に透明にスライドすると元の写真が見え、完全に不透明にすると翻訳が読めます。

結果ページの解剖

なぜブロック単位の翻訳なのか

編集の動作

オーバーレイは写真の上にレンダリングされ、焼き付けられません。履歴に保存すると、元の写真とブロックごとの翻訳レコードの両方が保存されます。保存されたエントリを開くと、オーバーレイが正確に再現されます。写真の編集はサポートされていません。