文本翻译 vs 拍照翻译:选择哪一个
应用有两个翻译入口:相机页面(拍照翻译)和文本翻译页面。它们共享相同的语言对状态和相同的 ML Kit 引擎,但管道在一个重要步骤上有所不同。
一句话的差异
拍照翻译对捕获的图像运行 OCR,然后翻译识别出的文本。文本翻译完全跳过 OCR,直接将输入馈送给翻译引擎。
文本翻译更快的时候
- 已经是文本的源。 邮件、聊天消息、网页片段、粘贴的段落 — 任何作为文本存在而不是印刷页面的内容。跳过 OCR 移除了一个步骤并消除了一类 OCR 错误(误读字符、断行错误、布局混乱)。
- 长而密集的文本。 拍摄满屏文本会引入 OCR 噪音。粘贴文本不会。
- 听写。 系统听写键让你说话而不是输入。听写在安静环境中对清晰语音准确率良好。
- 没有相机可用。 如果相机正被另一个应用使用,或者相机权限被拒绝,文本翻译仍然有效。
拍照翻译更快的时候
- 印刷页面。 书籍、菜单、标志、包装、说明书、海报。这些是纸上的墨水;将它们放入文本的唯一方法是拍照。
- 贴纸和标签。 可以在适当位置翻译产品上的贴纸或标签的照片,而无需先转录。
- 无法选择的屏幕。 如果源呈现为像素 — PDF 中的图像、旧应用的截图、屏幕照片 — 没有文本可以复制。拍照翻译是唯一的选择。
- 双语标志。 在单张照片中捕获两种语言通常可以解决自动检测使用的按块语言提示。
准确性差异
两条路径使用相同的 ML Kit 引擎,因此翻译本身具有相同的质量。差异在更上游:拍照翻译可能引入文本翻译不会产生的 OCR 噪音。如果 OCR 引擎误读一个字符,翻译引擎就无法恢复原始文本。
对于你控制的文本(你自己的写作、自己的消息),粘贴它。对于活在纸上的文本,拍摄它。
模式之间的共享
源语言和目标语言设置在相机页面和文本翻译页面之间共享。在一个地方切换语言会应用到另一个;来回切换不需要重新选择语言。
文本翻译不会自动保存到历史;它们存在于结果区域,直到你点击清除或导航离开。相机翻译可以从结果页面保存到历史。
一个实用的规则
如果你能复制文本,就复制它。如果你不能,就拍摄它。复制路径更清晰,因为 OCR 被从循环中移除了。