OCR图像翻译设置
在此面板,您不仅能选择最合适您游戏场景的识别语言模型并配置翻译语言,还能通过精细的调节参数,自定义图像增强和文字块的段落重组合并方式,从而应对各种带有复杂排版和噪点的 UI 界面。同时,OCR 图像翻译的叠加层样式、截图框与固定模式也在此配置。
翻译语言设置
- OCR识别语言:选择用于识别截图文字的语系模型。系统引擎提供了高度细分的离线视觉识别模型来提高处理速度和精度:
- 中英日混合(默认):兼顾最主流的欧美和日系游戏界面,主力模型。
- 繁体中文、韩语、拉丁语系、西里尔语系、阿拉伯语、希腊语:对于完全只出现一种特定语系的情况,可以手动切换来摒弃通用模型可能存在的错误匹配。
- 翻译源语言:OCR识别文字的源语言,可设为"自动"自动检测语种。
- 翻译目标语言:希望翻译成的语言(通常设为您的母语,如中文)。
翻译叠加层设置
控制 OCR 图像翻译结果叠加层的文字与背景色彩以及深度呈现。
- 文字颜色:为翻译好的内容选择字体颜色(RGB)。如果您习惯深夜打游戏,这有助于减缓眼部疲劳。
- 背景颜色:调节文字底层的背景色,默认为白色。
- 背景透明度:若担心挡住正前方关键游戏元素,可将该滑块从
1.0(完全不透明)拉至0.0(完全透明)。建议配合文字颜色的强化来保证可读性。 - 文字区块景深模式:控制翻译文字区块在 3D 空间中的深度计算方式。
- 整体平面:整个文字区块作为一个整体平面进行景深定位,视觉上更稳固一致。
- 空间独立:区块内的文字元素在空间深度上相对独立,能更好地贴合曲面或不规则界面。
翻译截图区域设置
提供手柄选择框出现时的辨识度和选区设定。不依靠手柄实体按压调整边框的情况下亦能设定默认的投射区域。
- 启用手柄调节截图框:是否允许在游戏中通过按住握持键并移动手柄来调整截图框大小。
- 截图框颜色:选择框框体渲染颜色(RGB)。默认浅蓝青色。
- 截图框透明度:调节截图框框体的透明度(
0.1~1.0,默认0.8),过低可能导致框线难以看清。 - 截图框宽度 / 截图框高度:截图框在视野中占的宽度与高度比例(宽度默认
33%、高度默认21%)。 - 截图框 X 位置 / Y 位置:微调框体位于视野正中偏右上下区域的值(
35%~65%,默认50%)。 - 截图框景深距离(米):设定截图框屏幕空间前推的绝对三维深度(
0.2~5.0,默认2.0)。
图像前处理增强
游戏画面往往并不是最优质的"黑底白字"排文,这些开关用于在把截图传入 OCR 引擎前"整顿"画质:
- 增强对比度:如果因为游戏场景过于黑暗(例如洞穴深处或者有背光导致截取的字体暗淡),此项可提升文本亮度与背景区别度。
- 锐化:某些 VR 游戏抗锯齿设置过高或分辨率跟不上时,字体边缘易发虚,开启此处对原生文字边缘进行边界重塑和锐度强化。
- 降噪:适合用于画质颗粒感重或者拥有大量干扰效果(如复古滤镜、像素风环境、雾气粒子干扰等),能避免误读取为奇怪的符号。
OCR 面板合并与排版深度设置
由于游戏界面的对话框往往有自己天马行空的字符间距和断行规则,部分断行或者空行会被简单地当做独立的句子导致单次翻译成"车祸现场"。下列的所有滑块(带有重置↺功能)可以极大程度改变系统的合并判断行为。
预设合并参数一键策略
为您预先设定的经验值组合。当您随意拉动下方的任何详细滑块时,也会自动跳转到**"自定义"**配置槽位上。
- 预设档位:
无(极少合并)/窄/标准(默认)/宽(容忍更多乱行导致的距离断裂)/自定义
文本块横向合并容差
- 合并高度容差:限制相连两个文本块的整体高低差距。通过这层滤网能避开同宽但大小不一的"UI元素杂质"被并入一句话里的危险。(默认
0.2) - 水平高度容差:处理长文单行文本时,限制水平距离内能跨过最高与最低字体的比例极值。(默认
0.1) - 水平重叠像素边界:设定
-20至20px。负数表示允许字间隔,正数表示需要相互叠加或字体重叠。(默认-2) - 水平 Y 轴最大间距:判断两个横向排列的词组是否"属于同一行"而设立的纵截面极差范围。(默认
0.5)
文本段落垂直重构与换行判定
- 垂直高度容差:限制上下文关联时的垂直极限容错。(默认
0.3/0.5) - 垂直 X 轴对齐容差:限制了上下相邻两行首字对齐偏移的情况不能超过多少个字符宽度。(默认
1.5) - 垂直最大间距:同一次翻译请求中所允许的空行截断极限,超过这间距将被抛弃或视为不同句。(默认
0.15) - 垂直角度容差:应对一些有倾斜设计或者弧度的对话面板。单位为角度。(默认
2.0°) - 垂直重叠最小比例:垂直相连元素发生上下切边重叠时所允许的最小基准。(默认
0.0) - 垂直段落间距倍数:检测到垂直距离超过系统标准行距多少倍时就将下面认定成新段落,触发强制换行。(默认
1.5) - 垂直最小新段落间距:同上判定要求,设定强制新段的最少相隔固定物理像素阈值。(默认
80到150px)
翻译叠加层固定模式
控制 OCR 翻译结果贴片的显示方式:
- 固定在世界空间:翻译贴片锚定在 VR 场景中的特定位置,转动头部不会跟随移动,具有真实的三维空间感。(默认选项)
- 固定在眼前:翻译贴片始终跟随您的视线方向,显示在视野正前方固定位置,适合需要随时查看翻译的场景。