テキスト翻訳 vs 写真翻訳:どちらを使うべきか
アプリには翻訳の 2 つのエントリーポイントがあります:カメラページ(写真翻訳)とテキスト翻訳ページです。同じ言語ペア状態と同じ ML Kit エンジンを共有しますが、パイプラインは 1 つの重要なステップで異なります。
一文での違い
写真翻訳はキャプチャした画像に対して OCR を実行し、認識されたテキストを翻訳します。テキスト翻訳は OCR を完全にスキップし、入力を翻訳エンジンに直接送ります。
テキスト翻訳が高速な場合
- すでにテキストであるソース。 メール、チャットメッセージ、ウェブのスニペット、貼り付けた段落 — テキストとして存在し、印刷ページではないもの。OCR をスキップすることでステップが削除され、OCR エラーのクラス(誤読文字、改行の崩れ、レイアウトの乱れ)が排除されます。
- 長くて密度の高いテキスト。 画面いっぱいのテキストを撮影すると OCR ノイズが導入されます。テキストを貼り付ける場合は導入されません。
- ディクテーション。 システムのディクテーションキーを使うと、入力する代わりに話すことができます。静かな環境での明瞭な音声に対してディクテーション精度は良好です。
- カメラが利用できない場合。 カメラが他のアプリで使用されている場合、またはカメラの権限が拒否された場合でも、テキスト翻訳は機能します。
写真翻訳が高速な場合
- 印刷ページ。 本、メニュー、標識、包装、説明書、ポスター。これらは紙の上のインクであり、それらをテキストにする唯一の方法は撮影することです。
- ステッカーとラベル。 製品のステッカーやラベルの写真は、最初に転記することなくその場で翻訳できます。
- 選択できない画面。 ソースがピクセルとしてレンダリングされている場合(PDF 内の画像、古いアプリのスクリーンショット、画面の写真)、コピーするテキストがありません。写真翻訳が唯一の選択肢です。
- 二か国語標識。 1 枚の写真で両方の言語をキャプチャすると、自動検出が使用するブロックごとの言語ヒントが解決されることがよくあります。
精度の違い
両方のパスは同じ ML Kit エンジンを使用するため、翻訳自体の品質は同じです。違いはより上流にあります:写真翻訳はテキスト翻訳では生じない OCR ノイズを導入する可能性があります。OCR エンジンが文字を誤読した場合、翻訳エンジンは元のテキストを復元する方法がありません。
あなたがコントロールするテキスト(あなた自身の執筆、あなた自身のメッセージ)は、貼り付けてください。紙の上にあるテキストは、撮影してください。
モード間の共有
ソース言語とターゲット言語の設定は、カメラページとテキスト翻訳ページの間で共有されます。ある場所で言語を切り替えると、もう一方にも適用されます;行ったり来たり切り替えしても、言語を再選択する必要はありません。
テキスト翻訳は自動的に履歴に保存されません;クリアをタップするかナビゲートするまで、結果領域に存在します。カメラ翻訳は結果ページから履歴に保存できます。
実用的なルール
テキストをコピーできるなら、コピーしてください。できないなら、撮影してください。OCR がループから削除されるため、コピーパスの方がクリーンです。