Reglyph अब स्कैन की हुई और सिर्फ़ इमेज वाली PDF में विषय-सूची (कंटेंट्स) वाले पेज पहचानता है और उनका अनुवाद एक-एक एंट्री करके करता है। हर अनूदित एंट्री अपनी मूल लाइन पर रहती है, बिंदुओं वाली लाइन दाएँ किनारे तक जाती है, पेज नंबर दाईं ओर अलाइन रहते हैं और अध्यायों के शीर्षक अपनी हेडिंग पट्टी के अंदर ही रहते हैं।
पहले पूरा कंटेंट्स पेज कभी-कभी एक ही लंबे, लगातार पैराग्राफ़ के रूप में लौट आता था। हमने यह बदलाव 50 पेज के एक जापानी उपकरण मैनुअल की कई पेज लंबी विषय-सूची पर टेस्ट किया, जिसका अनुवाद अंग्रेज़ी में किया गया।
Reglyph अब अनूदित PDF में टेक्स्ट ब्लॉक के अंदर के लाइन ब्रेक बनाए रखता है। नंबर वाली और बुलेट वाली लिस्ट के आइटम, “नोट:” से शुरू होने वाली लाइनें और कोष्ठक में लिखी टिप्पणियाँ मूल की तरह अलग-अलग नई लाइन से शुरू होती हैं, एक ही पैराग्राफ़ में मिलकर नहीं रह जातीं। जिस 50 पेज के मैनुअल पर हमने टेस्ट किया, उसमें लगभग आधे पेजों पर इस बदलाव का असर पड़ा।
जिन पेजों में टेक्स्ट के साथ डायग्राम, फ़ोटो या टेबल हैं, वे अब Reglyph में काफ़ी जल्दी पूरे हो जाते हैं। चित्रों से भरे 50 पेज के एक उपकरण मैनुअल पर टेस्ट में ज़्यादा चित्रों वाले पेज पहले से लगभग तीन गुना तेज़ प्रोसेस हुए, इसलिए मैनुअल और रिपोर्ट जैसे लंबे, चित्रों वाले दस्तावेज़ जल्दी तैयार हो जाते हैं।
Reglyph की वेबसाइट अब अरबी (दाएँ से बाएँ), तुर्की, हिंदी और इंडोनेशियाई में भी उपलब्ध है — अंग्रेज़ी, जापानी, सरल और पारंपरिक चीनी, स्पैनिश, पुर्तगाली, फ़्रेंच और जर्मन के साथ। हेडर में दिए भाषा मेन्यू से आप इनके बीच बदल सकते हैं।
Reglyph अब अनुवाद के शब्द ऐसे चुनता है कि उसकी लंबाई मूल टेक्स्ट के क़रीब रहे, ताकि अनूदित टेक्स्ट पेज पर उतनी ही जगह में फ़िट हो जाए जितनी मूल टेक्स्ट ने ली थी और उसे कम छोटा करना पड़े। जो पेज एक चौथाई घूमकर (90 डिग्री पर) स्कैन हुए हों, वे भी अब ज़्यादा भरोसेमंद ढंग से पहचाने जाते हैं।
Reglyph अब हर पेज पर जाँचता है कि पहचाना गया टेक्स्ट उसी लिपि में है या नहीं जिसमें दस्तावेज़ लिखा गया है, और जहाँ मेल नहीं बैठता, वहाँ पेज को दोबारा पढ़ता है। इससे उन कम सपोर्ट वाली लिपियों के स्कैन में आने वाला बिगड़ा हुआ टेक्स्ट ठीक हो जाता है। जॉर्जियन ऐसी पहली भाषा है और इसे सोर्स भाषा के रूप में चुना जा सकता है।
अगर अनुवाद पूरा होने से पहले आप पेज छोड़ देते हैं, तो तैयार होते ही Reglyph आपको ईमेल कर देता है, इसलिए लंबे दस्तावेज़ों के लिए ब्राउज़र टैब खुला रखने की ज़रूरत नहीं।
आड़े स्कैन हुए पेज और लैंडस्केप पेज अब Reglyph पहचान लेता है, अनुवाद से पहले उन्हें सीधा करता है और अनूदित PDF में उन्हें फिर से उनकी मूल दिशा में लौटा देता है।
वॉटरमार्क, लोगो या बैकग्राउंड पैटर्न के ऊपर छपे टेक्स्ट का अनुवाद अब Reglyph बाक़ी टेक्स्ट की तरह ही करता है, जबकि असली हस्ताक्षर और मुहर बिल्कुल वैसे ही रहते हैं। जिन हेडर और लेटरहेड में कोई अर्थपूर्ण जानकारी होती है, जैसे जारी करने वाली संस्था, दस्तावेज़ का शीर्षक या फ़ुटनोट, उनका अनुवाद होता है; पेज नंबर और रेफ़रेंस ID को छुआ नहीं जाता।
ऊपर से नीचे वर्टिकल कॉलम में लिखे जापानी पेज (इस लेखन शैली को जापानी में tategaki कहते हैं) अब Reglyph अनुवाद करके हॉरिज़ॉन्टल टेक्स्ट के रूप में सेट करता है, ताकि अनूदित पेज अंग्रेज़ी और आड़ी लाइनों में लिखी जाने वाली दूसरी भाषाओं में सहज ढंग से पढ़ा जा सके।
Reglyph में अनूदित PDF के साथ आप एक द्विभाषी PDF भी डाउनलोड कर सकते हैं, जिसमें हर मूल पेज और उसका अनुवाद आमने-सामने होते हैं, जिससे अनुवाद को मूल से मिलाकर जाँचना आसान हो जाता है। अपलोड करते समय यह विकल्प चुनें, और यह अनुवाद के साथ ही तैयार मिलेगा।