目錄頁維持原本的版面
Reglyph 現在能辨識掃描檔與純影像 PDF 中的目錄頁,並逐條翻譯。每一條譯文都留在原本那一行,點狀前導線一路延伸到右側邊緣,頁碼維持靠右對齊,章節標題也仍在各自的標題框內。
過去整頁目錄有時會被譯成一整段連在一起的文字。這項改進以一份 50 頁日文設備手冊實際測試:把其中跨越多頁的目錄翻譯成英文。
Reglyph 現在能辨識掃描檔與純影像 PDF 中的目錄頁,並逐條翻譯。每一條譯文都留在原本那一行,點狀前導線一路延伸到右側邊緣,頁碼維持靠右對齊,章節標題也仍在各自的標題框內。
過去整頁目錄有時會被譯成一整段連在一起的文字。這項改進以一份 50 頁日文設備手冊實際測試:把其中跨越多頁的目錄翻譯成英文。
Reglyph 翻譯後的 PDF 現在會保留文字區塊內的換行。編號清單與項目符號清單的每一項、以「註:」開頭的行,以及括號裡的補充說明,都會跟原件一樣各自另起一行,不會再被併成一整段。在我們測試的那份 50 頁手冊中,將近一半的頁面都有這種情形。
Reglyph 處理文字搭配圖解、照片或表格的頁面,現在快了很多。以一份 50 頁、附插圖的設備手冊測試,圖片較多的頁面處理速度約為先前的三倍,手冊、報告這類圖文並茂的長篇文件可以更快完成。
Reglyph 網站除了英文、日文、簡體中文、繁體中文、西班牙文、葡萄牙文、法文與德文之外,現在也提供阿拉伯文(由右至左排版)、土耳其文、印地文與印尼文版本。用頁首的語言選單就能切換。
Reglyph 翻譯掃描 PDF 時,現在會讓譯文用字盡量貼近原文長度,讓譯文放得進原文在頁面上占用的空間,比較不需要縮小字級。掃描時轉了 90 度的頁面,現在也能更穩定地偵測出來。
Reglyph 現在會檢查每一頁辨識出的文字,是否符合文件所使用的書寫系統,不符合的頁面會重新辨識。這修正了以支援度較低的文字書寫的掃描檔出現亂碼的問題。喬治亞文是第一個適用的語言,現在可以選為來源語言。
如果翻譯還沒完成你就先離開,Reglyph 會在譯文完成時寄 Email 通知你,翻譯長篇文件也不必一直開著瀏覽器分頁。
Reglyph 現在會偵測掃描檔中橫著掃描的頁面與橫式頁面,翻譯前先轉正,再於譯文 PDF 中恢復原本的方向。
Reglyph 現在會把印在浮水印、標誌或背景圖樣上的文字當成一般文字翻譯,真正的簽名與印章則完全保留。帶有實際資訊的頁首與信頭,例如核發機關、文件標題或註腳,會一併翻譯;頁碼與參考編號則維持不動。
Reglyph 現在可以翻譯直排(縦書き)的日文頁面,並改成橫排版面,讓譯文頁面用英文或其他橫式書寫的語言讀起來都很自然。
除了譯文 PDF,Reglyph 也能下載雙語 PDF:每一頁原文與譯文左右並排,方便對照原文檢查譯文。上傳時選取這個選項,就會跟譯文一起完成。