Përkthimi me makinë tani është aq i mirë sa, në shumë raste, është e pamundur ta dallosh nga përkthimi njerëzor. Shërbimet e përkthimit prodhojnë tekst të rrjedhshëm, idiomatik, me një ndjesi të mprehtë të regjistrit. Pastaj përkthen një grup të dhënash DPP - dhe papritmas ‘rear lock fibre closure’ bëhet ‘Hinterschloss-Faserverschluss’.
Problemi është terminologjia teknike. Këtu shpjegojmë pse të dhënat e produkteve nuk duhet të trajtohen si romane dhe cilat mjete ofron Transpareo për t’u siguruar që 40 versionet tuaja gjuhësore të mbeten të kuptueshme.
Problemi themelor: një fjalë, kuptime të shumta
‘Seal’ në DPP për një xhaketë të jashtme: hidroizolim. ‘Seal’ në një laborator: një fokal (kafshë) ose një xhupë, në varësi të kontekstit. ‘Seal’ në një regjistër mirëmbajtjeje: ndoshta një vulë (si stampë).
Një model i përgjithshëm përkthimi bën zgjedhjen e tij bazuar në kontekstin statistikor. Kjo funksionon për tekst të vazhdueshëm - një roman ofron shumë kontekst. Por për një fushë të të dhënave si primary_closure: seal, pothuajse nuk ka fare kontekst. Modeli bën një supozim të arsyeshëm.
Rezultati janë gabime të holla. Jo aq dramatike sa ‘Hinterschloss fibre fastening’, por të rëndësishme: një komponent i quajtur ‘Dichtung’ në gjermanisht papritmas i referohet si ‘sigillo’ në vend të ‘guarnizione’ në një DPP italiane . Një blerës nuk mund ta gjejë më pjesën e rezervë.
Çfarë bën Transpareo sot
Sistemi ynë i përkthimit përkthen automatikisht të gjithë përmbajtjen e re në të gjitha gjuhët aktive. Ai karakterizohet nga katër veçori kryesore:
-
Ruajtja e Markdown-it dhe e variablave: Vendëvendosjet si
<a href="/sq/regjistrohu">Pro-Membership</a>dhe strukturat Markdown nxirren para përkthimit; teksti i thjeshtë përkthehet, dhe pastaj strukturat ri-futën të paprekura. Kjo siguron që lidhjet, formularët dhe paraqitja të mbeten të qëndrueshme në të gjitha gjuhët. - Hyrje të centralizuara për përkthim: Përkthimet nuk ruhen brenda vetë regjistrit të të dhënave, por në një shtresë të përbashkët. Shumë regjistra të të dhënave me të njëjtin tekst burim ndajnë një përkthim të vetëm. Kjo kursen në kostot e përkthimit dhe standardizon automatikisht terminologjinë në të gjithë modelin e të dhënave.
- Përkthim automatik i ri pas ndryshimeve: Nëse teksti origjinal ndryshohet, përkthimet në të gjitha gjuhët rigjenerohen. Një korrigjim në gjermanisht përditëson automatikisht 39 versionet e tjera gjuhësore.
- Shënime për çdo regjistër të të dhënave: Përmbajtja mund të përjashtohet nga përpunimi automatik, ose përkthimet ekzistuese mund të bllokohen - për shembull, për emrat ndërkombëtarë të produkteve ose korrigjime manuale.
Kur klienti plotëson përpunimin
Përkthimi automatik kryesisht jep rezultate të sakta për tekstet përshkruese, kopjet e marketingut dhe udhëzimet e kujdesit. Megjithatë, me terminologjinë teknike kritike - si ‘seal’/’guarnizione’ - mbeten një numër i vogël gabimesh, të cilat administratori i klientit duhet t’i korrigjojë.
Këtu, administratori ka tre opsione:
- Ndryshim manual për gjuhë dhe çelës: Çdo hyrje përkthimi mund të hapet në Menaxherin e Aplikacionit dhe të rregullohet për secilën gjuhë. Duke zgjedhur opsionin ‘kyç’, ky përkthim manual do të ruhet në ekzekutimin automatik të ardhshëm.
- Importim i fjalorit: Terminologjia ekzistuese nga mjetet e përkthimit ose fjalorët PDF mund të importohet si skedar CSV dhe të përdoret për të gjeneruar hyrje përkthimi drejtpërdrejt.
- Korrigjime për çdo gjuhë ndërsa sistemi po funksionon: Një ekip shitjesh italian vëren një gabim, e korrigjon atë në Menaxherin e Aplikacionit - korrigjimi hyn në fuqi menjëherë, ndërsa përkthimet e tjera mbeten të pandryshuara.
Menaxheri i Aplikacionit mbështet të 40 gjuhët
Nuk janë vetëm fletët e të dhënave të produktit që janë shumëgjuhëshe - edhe ndërfaqja në të cilën i mirëmbani ato është ## e tillë. Menaxheri i Aplikacionit është përkthyer në të 40 gjuhët, dhe mund të shkruani përmbajtje në cilëndo prej këtyre gjuhëve. Sistemi e përkthen automatikisht në të gjitha të tjerat.
Për ekipet shumëgjuhëshe, kjo bën një ndryshim të dukshëm në bashkëpunim: ekipi i menaxhimit të produktit në Milano shkruan udhëzimet e përdorimit në italisht, ekipi i prokurimit në Varshavë shton të dhënat e materialit në polonisht, dhe ekipi i sigurimit të cilësisë në Hamburg kontrollon detajet në gjermanisht. Të gjithë punojnë në gjuhën e tyre, të gjithë shohin të njëjtin grup të dhënash - dhe kushdo që korrigjon një informacion, e korrigjon atë për të gjitha versionet gjuhësore në të njëjtën kohë.
Edhe këtu zbatohet vërejtja e përmendur më sipër: në rastin e terminologjisë teknike kritike, në fund një person duhet të kontrollojë atë që ka zgjedhur makina.
Realiteti i gjuhëve të BE-së
24 gjuhë zyrtare të BE-së duken shumë. Në praktikë, ka tre nivele:
- Tregjet kryesore: DE, EN, FR, IT, ES, NL - këtu, çdo konsumator pret përsosmëri
- Tregje të rëndësishme: PT, PL, SV, DA, FI - një standard i mirë, megjithëse ndikimi i makinës herë pas here është i dukshëm
- Gjuha të rralla: MT, GA, ET, LV, LT - ndonjëherë keni një DPP në malteze pa asnjë konsumator përfundimtar në Maltë që ta skanojë ndonjëherë. Megjithatë, është i detyrueshëm.
Ky kërkesë nuk është fakultative. ESPR-ja kërkon që përmbajtja e DPP-së të ofrohet në gjuhën e Shtetit Anëtar ku shitet produkti. Prandaj, çdo kompani që furnizon 27 vende ka për t’u marrë me 24 gjuhë (disa vende ndajnë gjuhë).
Nga malteze në bengali
Transpareo përkthen në 40 gjuhë - të gjitha 24 gjuhët zyrtare të BE-së dhe 16 të tjera për një shtrirje globale:
- Evropë: Bullgarisht, Danisht, Gjermanisht, Anglisht, Estonisht, Finlandisht, Francisht, Greqisht, Irlandisht, Italisht, Kroalisht, Latvisht, Lituanisht, Malteze, Holandeze, Poloneze, Portugalisht, Rumune, Suedeze, Sllovake, Sllovene, Spanjolle, Çeke dhe Hungareze - plus Shqipe, Boshnjake, Islandisht, Maqedonisht, Norvegjisht, Rusisht, Serbisht, Turqisht dhe Ukrainisht.
- Në mbarë botën: Bengali, Kinezisht, Hindi, Indonezisht, Japonisht, Koreanisht dhe Vietnamisht.
Për DPP-në e ardhshme të tekstilit, gjuhët bengali dhe vietnameze mbulojnë vendet kryesore prodhuese - një furnizues në Dhaka lexon të njëjtin pasaportë produkti si një blerës në Paris.
Pse një shtresë lokalizimi e centralizuar
Shumica e platformave ruajnë përkthimet si fusha shtesë në regjistrin e të dhënave: description_de, description_en, … 40 fusha për çdo atribut të përkthyeshëm. Duket e thjeshtë, por ka tre të metë:
- Tekst i dyfishtë. Dy produkte me të njëjtën përshkrim të materialit gjenerojnë 40 + 40 përkthime në vend të vetëm 40
- E vështirë për t’u shkallëzuar. Shtimi i një gjuhe të 41-të kërkon migrim të skemës në të gjitha modelet e përkthyeshme
- Korrigjimet janë të vështira për t’u aplikuar në mënyrë globale. Nëse ‘guarnizione’ korrigjohet kudo, të gjitha rekordet e të dhënave do të duhet të redaktohen individualisht
Shtresa e përkthimit e ndarë e zgjidh këtë: një hyrje, shumë referenca. Një korrigjim, të gjitha rekordet e të dhënave përfitojnë.
Çfarë nuk kemi ende
Një bazë të dhënash terminologjike e personalizuar me njohjen automatike të sugjerimeve është në zhvillim, por aktualisht nuk është e disponueshme. Çdokush që fillon sot mund të arrijë shumë me mjetet ekzistuese: mbishkrimet manuale, importet e fjalorëve dhe flamuri ‘mbaje’ mbulojnë rastet më të zakonshme të përdorimit.
Ne besojmë se makinat duhet të bëjnë pjesën më të madhe të punës dhe se njerëzit duhet të ndërhyjnë vetëm kur është vërtet e nevojshme. Derisa të jetë e disponueshme njohja automatike e terminologjisë, procesi manual është transparent - dhe kjo është më e ndershme se një premtim që nuk mbahet.
