块叠加层解析:翻译如何落在照片上

Last updated: 2026-09-03

块叠加层解析:翻译如何落在照片上

结果页面将翻译渲染回原始照片之上,每个 OCR 块一个叠加层。每个块的翻译出现在 OCR 引擎在其中检测到源文本的确切矩形中。本文解释叠加层如何布局、它如何与照片交互以及如何阅读它。

为什么按块

OCR 返回的是块列表,而不是单个字符串。每个块都带有自己的边界框、检测到的文本和置信度分数。结果页面将每个块视为一个独立的单元:

翻译如何流式传输

每个检测到的块作为独立的翻译作业发送到 ML Kit。翻译在完成时流入叠加层;用户看到块按引擎完成的顺序"变成"翻译。叠加层增量更新;整个页面不显示阻塞旋器。

叠加层如何定位

翻译文本被换行并定位以适应源块的边界框。如果块很窄,翻译会换行成多行,并可能稍微溢出源矩形;引擎优先考虑可读性而不是严格包含。

叠加层渲染在照片之上,而不是烘焙到照片中。保存到历史会存储原始照片和按块的翻译记录。打开保存的条目会精确重现叠加层。

透明度滑块

工作表顶部的滑块控制叠加层的不透明度。滑到完全透明以查看原始照片,完全不透明以阅读翻译。半透明是比较原始和翻译的常见设置,无需离开页面。

点击聚焦

点击翻译的块会打开一个底部工作表,滚动到"完整翻译"视图中的相同块。这对于照片上翻译被截断或换行而隐藏完整句子的块非常有用。

结果页面解剖

为什么有些块显示警告

当 OCR 置信度低于阈值时,警告徽章会出现在块上。该块仍会被翻译和渲染,但会告知用户检查它。常见原因:低光、眩光、手写、装饰字体、非常小的文本。

保存

保存到历史会捕获照片(压缩为缩略图)、OCR 块、按块翻译以及连接的完整段落。打开保存的条目会精确重现叠加层;不支持编辑照片。