Hindi ir lotyniškų rašmenų konverteris sukurtas išspręsti griežtai mechaninę problemą. Jūs žiūrite į devanagari – elegantišką, itin fonetinį raštą, kurį prilaiko ištisinė horizontali viršutinė linija, žinoma kaip shirorekha. Gimtakalbiui skaitytojui tai – nuostabiai logiška priebalsių ir balsių žymeklių sistema. Nepažįstančiam šio rašto, tai neįžengiamas kilpų, žemyn nusileidžiančių kabliukų ir pusinių priebalsių miškas, kuris griežtai atsisako būti perskaitytas, kol nepereisite mėnesių trunkančio fonetinio pasiruošimo. Šis įrankis pašalina kaligrafiją ir tiesiog pateikia jums romanizuotą atitikmenį.

Norėdami suprasti, ką sukuria šis konverteris, turite suprasti, kas yra formali transliteracija. Skirtingai nei anglų kalba, kurioje rašyba iš esmės yra istorinis atsitiktinumas ir atsitiktinių spėliojimų seka (prisiminkime angliškus though, through ir tough), devanagari yra abugida. Kiekvienas rašmuo turi tikslią, nekintančią fonetinę vertę. Kai mūsų įrankis konvertuoja tai į lotynišką abėcėlę, jis nenaudoja chaotiškos, improvizuotos rašybos, kurią matote socialiniuose tinkluose (dažnai vadinamos „Hinglish“). Vietoj to, jis remiasi griežtais akademiniais standartais – dažniausiai atitinkančiais ISO 15919 arba IAST. Tai reiškia, kad pamatysite brūkšnelius virš ilgųjų balsių (pvz., ā arba ī) ir taškus po retrofleksiniais priebalsiais (pvz., ir ). Tai tikslu, pedantiška ir nepalieka jokio dviprasmiškumo apie tai, kaip žodis buvo užrašytas originaliai.

Tuomet susiduriame su liūdnai pagarsėjusiu šva (schwa) išmetimu. Devanagari struktūra tokia, kad kiekvienas priebalsis savaime turi „a“ garsą, nebent jis aiškiai atšaukiamas. Tačiau šnekamojoje hindi kalboje kalbantieji natūraliai praleidžia šią trumpąją „a“ žodžių galuose ir kai kuriuose viduriniuose skiemenyse. Būtent todėl dievybė paprastai vadinama „Ram“, o ne „Rama“, o šalis – „Bharat“, o ne „Bharata“. Formali algoritminė transliteracija, kurią naudoja šis įrankis, pareigingai išsaugo pamatinę rašto struktūrą. Jis transliteruoja tekstą tiksliai taip, kaip jis užrašytas, įskaitant ir tuos tyliuosius fonetinius inkarus. Laikykite tai tekstinio tikslumo savybe, o ne pokalbių gidu.

Vartotojai nuolat turi naivią viltį, kad šis procesas gali lengvai veikti atvirkščiai. Žmonės tikisi įrankyje įvesti kasdienišką, neakcentuotą romanizuotą hindi kalbą, pavyzdžiui, „kya haal hai“, ir tikisi, kad kompiuteris be priekaištų atspės teisingą devanagari rašybą. Leiskite nedelsiant išsklaidyti šią iliuziją. Romanizuotas internetinis hindi yra anarchiška fonetinių aproksimacijų dykvietė. Viena lotyniška „d“ gali reikšti švelnią dantų „d“ (द) arba kietą retrofleksinę „d“ (ड). Be žmogaus, darančio kontekstinius sprendimus per įvesties metodo redaktorių (IME), kasdienio lotyniško teksto pavertimas atgal į devanagari yra beprasmis darbas. Mes teikiame deterministinį konverterį, o ne minčių skaitytuvą.

Šio konkretaus įrankio architektūra yra nuostabiai brutali savo paprastumu. Jis nesiremia trapiomis, trečiųjų šalių JavaScript bibliotekomis, kurias nuolat užblokuoja reklamų blokatoriai, sekimo apsaugos ar pernelyg uolios įmonių užkardos (firewalls). Vietoj to, šis konverteris veikia išskirtinai jūsų serveryje, naudodamas į PHP giliai integruotą International Components for Unicode (ICU) variklį. Kai įklijuojate savo tekstą, serveris atlieka deterministinę devanagari į lotynų transliteraciją ir akimirksniu grąžina rezultatą. Jokių iškilmingų krovimo ekranų. Tik grynaskraujis, patikimas teksto apdorojimas.

Nesvarbu, ar esate lingvistikos studentas, skęstantis žodyne, turistas, bandantis suprasti, kas iš tikrųjų parašyta ženkle, ar tiesiog žmogus, bandantis perskaityti adresą ir netyčia per netaisyklingą tarimą neiškviesti nedidelio demono – šis įrankis yra jūsų ramentas. Jis nepakeičia sunkaus devanagari mokymosi darbo. Jis nepadaro jūsų sklandžiai kalbančiu. Bet jis pateikia patikrinamą, greitą fonetinį pareiškimą, kurį iš tikrųjų galite perskaityti. Stačiame, neatleidžiančiame brahminių raštų peizaže, tai skaitosi kaip pasigailėjimas.