目录页保持原有版式
Reglyph 现在能识别扫描件和纯图片 PDF 中的目录页,并逐条翻译。每条译文都留在原来那一行,点状前导符一直延伸到右侧边缘,页码保持右对齐,章节标题也仍位于各自的标题框内。
以前,整页目录有时会被译成一大段连在一起的文字。这项改进在一份 50 页日文设备说明书上做了测试:将其中跨越多页的目录译成英文。
Reglyph 现在能识别扫描件和纯图片 PDF 中的目录页,并逐条翻译。每条译文都留在原来那一行,点状前导符一直延伸到右侧边缘,页码保持右对齐,章节标题也仍位于各自的标题框内。
以前,整页目录有时会被译成一大段连在一起的文字。这项改进在一份 50 页日文设备说明书上做了测试:将其中跨越多页的目录译成英文。
Reglyph 翻译出的 PDF 现在会保留文本块内部的换行。编号列表和项目符号列表的每一项、以“注:”开头的行以及括号里的补充说明,都会像原件一样各自另起一行,不再被并成一整段。在我们测试的那份 50 页说明书中,将近一半的页面涉及这一改动。
Reglyph 处理文字与示意图、照片或表格混排的页面,现在快了很多。在一份 50 页带插图的设备说明书上测试,插图较多的页面处理速度约为以前的三倍,因此说明书、报告这类插图多的长文档能更早完成。
Reglyph 网站现在除了英语、日语、简体中文、繁体中文、西班牙语、葡萄牙语、法语和德语,还提供阿拉伯语(从右向左排版)、土耳其语、印地语和印度尼西亚语版本。通过页头的语言菜单即可切换。
Reglyph 翻译扫描 PDF 时,现在会让译文的措辞尽量贴近原文长度,使译文能放进原文在页面上所占的空间,需要缩小字号的情况更少。扫描时转了 90 度的页面,现在也能更可靠地检测出来。
Reglyph 现在会检查每一页识别出的文字是否与文档所用的文字系统一致,不一致的页面会重新识别。这修复了以支持度较低的文字书写的扫描件中出现乱码的问题。格鲁吉亚语是首个受益的语言,现已可选为源语言。
如果翻译还没完成你就离开了页面,Reglyph 会在译文完成后发邮件通知你,翻译长文档时也不必一直开着浏览器标签页。
Reglyph 现在会检测扫描件中侧着扫描的页面以及横版页面,在翻译前将其转正,并在译文 PDF 中恢复原来的方向。
Reglyph 现在会像处理其他文字一样,翻译印在水印、徽标或背景底纹上的文字,而真实的签名和印章则原样保留。带有实际信息的页眉和信笺抬头,例如签发机关、文件标题或脚注,会被翻译;页码和参考编号则保持不动。
Reglyph 现在可以翻译竖排(縦書き)的日文页面,并改为横排排版,让译文页面在英文及其他横排语言中读起来自然顺畅。
除了译文 PDF,Reglyph 还可以下载双语 PDF:每一页原文和译文左右并排,方便对照原文核对译文。上传时选择这一项,它会和译文一起生成。