A gépi fordítás manapság már olyan jó, hogy sok esetben nem lehet megkülönböztetni az emberi fordítástól. A fordítási szolgáltatások folyékonyan, idiomatikus módon, a stílusra való érzékkel működnek. Aztán lefordítunk egy DPP-adatsort - és hirtelen a „rear lock fiber closure” „hátsó zár szálzáró” lesz .
A probléma a szakszókincs. Itt elmagyarázzuk, miért nem szabad a termékadatokat úgy kezelni, mint a regényeket, és milyen eszközöket biztosít a Transpareo ahhoz, hogy a 40 nyelvi változatuk érthető maradjon.
Az alapvető probléma: egy szó, több jelentés
„Seal” egy outdoor kabát DPP-jében: tömítés. „Seal” egy laboratóriumban: fók vagy tömítés, a kontextustól függően. „Seal” egy karbantartási jegyzőkönyvben: bizonyos körülmények között pecsét.
Egy általános fordítási modell a statisztikai kontextus alapján választ. Folyékony szöveg esetén ez működik - a regény bőséges kontextust nyújt. Egy primary_closure: seal adatmező esetében alig van kontextus. A modell csak találgat.
Ennek következtében finom hibák keletkeznek. Nem olyan drámaiak, mint a „Hinterschloss-Faserverschluss”, de következményesek: egy alkatrész, amelyet németül „Dichtung”-nak neveznek, egy olasz DPP-ben hirtelen „sigillo”-nak hívják „guarnizione” helyett . Egy beszerző már nem találja meg a pótalkatrészt.
Mit nyújt ma a Transpareo
Fordítási rendszerünk minden új tartalmat automatikusan átvisz az összes aktív nyelvre. Négy tulajdonság jellemzi:
-
Markdown és változók megőrzése: a helyőrzőket, mint példáula
<a href="/hu/regisztralni">Pro-Mitgliedschaft</a>, és a Markdown-struktúrákat a fordítás előtt kivonjuk, a puszta szöveget lefordítjuk, majd a struktúrákat változatlanul visszahelyezzük. Így a linkek, űrlapok és az elrendezés minden nyelven konzisztens marad. - Központi fordítási bejegyzések: A fordításokat nem magában az adatrekordban tároljuk, hanem egy megosztott rétegben. Több, azonos eredeti szöveggel rendelkező adatrekord osztozik egy fordításon. Ez csökkenti a fordítási költségeket, és automatikusan egységesíti a kifejezéseket az adatmodell egészében.
- Automatikus újrafordítás módosítás esetén: Ha az eredeti szöveget módosítják, a fordítások minden nyelven újra generálódnak. Egy javítás a német nyelven - 39 másik nyelvi változat automatikusan követi.
- Adatrekordonkénti jelölések: A tartalmak kizárhatók az automatikus feldolgozásból, vagy a meglévő fordítások rögzíthetők - például nemzetközi terméknevek vagy kézi javítások esetén.
Ahol az ügyfél kiegészíti a feldolgozást
Az automatikus fordítás nagyrészt helyes eredményeket szolgáltat a leíró szövegek, marketing szövegek és karbantartási utasítások esetében. Kritikus szakszókincs - például a „seal”/„guarnizione” - esetén marad egy kis mennyiségű hiba, amelyet az ügyfél rendszergazdájának kell kijavítania.
Itt az adminisztrátornak három lehetősége van:
- Kézi felülírás nyelvenként és kulcsszóként: Minden fordítási bejegyzés megnyitható az Alkalmazáskezelőben, és nyelvenként módosítható. A rögzítés jelöléssel ez a kézi fordítás megmarad a következő automatikus futtatás során.
- Szótárimport: A fordítóeszközökből vagy PDF-szótárakból származó meglévő terminológiák CSV-fájlként importálhatók, és közvetlenül leírt fordítási bejegyzéseket hoznak létre.
- Nyelvenkénti javítások működés közben: Ha például az olasz értékesítési csapat hibát észlel, azt az Alkalmazáskezelőben kijavítja - a javítás azonnal hatályba lép, a többi fordítás változatlan marad.
Az Alkalmazáskezelő ugyanazt a 40 nyelvet támogatja
Nem csak a termékadatlapok többnyelvűek - hanem az a felület is, amelyen azokat karbantartja. Az Alkalmazáskezelő mind a 40 nyelvre le van fordítva, és Ön bármelyik nyelven rögzítheti a tartalmakat. A rendszer automatikusan lefordítja azokat az összes többi nyelvre.
A többnyelvű csapatok számára ez érezhetően megváltoztatja az együttműködést: a milánói termékmenedzsment olaszul írja meg a karbantartási utasításokat, a varsói beszerzés lengyelül egészíti ki az anyagadatokat, a hamburgi minőségbiztosítás pedig németül ellenőrzi azokat. Mindenki a saját nyelvén dolgozik, mindenki ugyanazt az adatsort látja - és aki egy adatot javít, az egyszerre javítja az összes nyelvi változatban.
Itt is érvényes a fentebb említett korlátozás: kritikus szakszókincs esetén végül egy embernek ellenőriznie kell, hogy a gép mit választott.
Az EU-nyelvek valósága
24 EU-hivatalos nyelv - ez soknak tűnik. A gyakorlatban három réteg van:
- Fő piacok: DE, EN, FR, IT, ES, NL - itt minden fogyasztó tökéletességet vár
- Jelentős piacok: PT, PL, SV, DA, FI - jó színvonal, néha észrevehető a gépi fordítás
- Ritka nyelvek: MT, GA, ET, LV, LT - néha van egy máltai nyelvű DPP, anélkül, hogy valaha is egy végfelhasználó Máltán beolvasná. Ennek ellenére kötelező.
Ez a kötelezettség nem opcionális. Az ESPR előírja, hogy a DPP-tartalmaknak annak a tagállamnak a nyelvén kell szerepelniük, ahol a terméket értékesítik. Aki 27 országot szolgál ki, annak tehát 24 nyelvet kell figyelembe vennie (néhány országban több nyelv is használatos).
A máltai nyelvtől a bengáliig
A Transpareo 40 nyelvre fordít - mind a 24 uniós hivatalos nyelvre, valamint további 16 nyelvre a globális lefedettség érdekében:
- Európa: bolgár, dán, német, angol, észt, finn, francia, görög, ír, olasz, horvát, lett, litván, máltai, holland, lengyel, portugál, román, svéd, szlovák, szlovén, spanyol, cseh és magyar - emellett albán, bosnyák, izlandi, macedón, norvég, orosz, szerb, török és ukrán nyelv is.
- Világszerte: bengáli, kínai, hindi, indonéz, japán, koreai és vietnámi.
A közelgő textil-DPP esetében a bengáli és a vietnámi nyelvvel lefedve vannak a nagy termelőországok - egy dhakai beszállító ugyanazt a leírást olvassa, mint egy párizsi beszerző.
Miért van szükség egy központosított lokalizációs rétegre?
A legtöbb platform a fordításokat kiegészítő mezőkként tárolja az adatrekordban: description_de, description_en, … 40 mező fordítható attribútumonként. Egyszerűnek tűnik, de három hátránya van:
- Duplikált szöveg. Két, azonos anyagmegjelöléssel rendelkező termék 40 + 40 fordítást eredményez, ahelyett, hogy egyszerre 40-et
- Nehezen skálázható. Egy 41. nyelv hozzáadása azt jelenti: sémamigráció az összes fordítható modellre kiterjedően
- A javítások nehezen alkalmazhatók globálisan. Ha a „guarnizione” szót mindenhol kijavítják, akkor az összes adatrekordot egyenként kellene szerkeszteni
A megosztott fordítási réteg megoldja ezt: egy bejegyzés, sok hivatkozás. Egy javítás, és az összes adatrekord részesül belőle.
Ami még nincs meg
Egy ügyfélspecifikus terminológiai adatbázis automatikus javaslatfelismeréssel a fejlesztési tervekben szerepel, de jelenleg még nem áll rendelkezésre. Aki ma kezd bele, a meglévő eszközökkel is messzire jut: a kézi felülírások, a szótárimportok és a rögzítési jelölés lefedik a leggyakoribb felhasználási eseteket.
Úgy véljük, hogy a gépeknek kell elvégezniük a munka nagy részét, az embereknek pedig csak ott kell beavatkozniuk, ahol valóban szükséges. Amíg az automatikus terminológiafelismerés elérhetővé nem válik, a kézi beavatkozás átlátható - és ez őszintébb, mint egy be nem tartott ígéret.
