Maskinöversättning är idag så bra att man i många fall inte längre kan skilja den från mänsklig översättning. Översättningstjänsterna fungerar smidigt, idiomatiskt och med känsla för stil. Men när man översätter en DPP-datauppsättning blir plötsligt ”rear lock fiber closure” till ”Hinterschloss-Faserverschluss”.
Problemet heter fackterminologi. Här förklarar vi varför produktdata inte ska behandlas som romaner och vilka verktyg Transpareo tillhandahåller för att dina 40 språkversioner ska förbli begripliga.
Grundproblemet: ett ord, flera betydelser
”Seal” i DPP-data för en friluftsjacka: tätning. ”Seal” i ett laboratorium: säl eller tätning, beroende på sammanhanget. ”Seal” i ett underhållsprotokoll: under vissa omständigheter ett sigill.
En allmän översättningsmodell väljer utifrån det statistiska sammanhanget. I en flytande text fungerar det - romanen ger gott om sammanhang. I ett datafält primary_closure: seal finns det knappt något sammanhang. Modellen gissar.
Följden blir subtila fel. Inte lika dramatiska som ”Hinterschloss-Faserverschluss”, men med stora konsekvenser: en komponent som på tyska kallas ”Dichtung” heter plötsligt ”sigillo” istället för ”guarnizione” i ett italienskt DPP . En inköpare kan inte längre hitta reservdelen.
Vad Transpareo erbjuder idag
Vårt översättningssystem överför automatiskt allt nytt innehåll till alla aktiva språk. Det kännetecknas av fyra egenskaper:
-
Bevarande av Markdown och variabler: Platshållare som
<a href="/sv/registrera-sig">Pro-Mitgliedschaft</a>och Markdown-strukturer extraheras före översättningen, själva texten översätts och därefter återinsätts strukturerna oförändrade. På så sätt förblir länkar, formulär och layout konsekventa på alla språk. - Centrala översättningsposter: Översättningarna sparas inte i själva dataposten utan i ett gemensamt lager. Flera dataposter med samma originaltext delar på en översättning. Detta sparar översättningskostnader och standardiserar automatiskt termerna över hela datamodellen.
- Automatisk omöversättning vid ändring: Om originaltexten ändras genereras översättningarna på nytt i alla språk. En korrigering på tyska - 39 andra språkversioner följer automatiskt.
- Markeringar per datapost: Innehåll kan undantas från den automatiska processen eller befintliga översättningar kan låsas - till exempel för internationella produktnamn eller manuella korrigeringar.
Där kunden kompletterar bearbetningen
Den automatiska översättningen ger till största delen korrekta resultat för beskrivande texter, marknadsföringstexter och skötselanvisningar. När det gäller kritisk fackterminologi - som ”seal”/”guarnizione” - kvarstår en viss mängd fel som kundens administratör måste korrigera.
Här har administratören tre verktyg:
- Manuell överskrivning per språk och nyckel: Varje översättningspost kan öppnas i Applikationshanteraren och anpassas per språk. Med markeringen ”Lås” behålls denna manuella översättning vid nästa automatiska körning.
- Import av ordlista: Befintlig terminologi från översättningsverktyg eller PDF-ordlistor kan importeras som CSV-fil och genererar direkt skrivna översättningsposter.
- Språkspecifika korrigeringar under drift: En italiensk säljare upptäcker ett fel, korrigerar det i Applikationshanteraren - korrigeringen träder i kraft omedelbart, medan de övriga översättningarna förblir oförändrade.
Applikationshanteraren stöder samma 40 språk
Det är inte bara produktpasserna som är flerspråkiga - även gränssnittet där du underhåller dem. Applikationshanteraren är översatt till alla 40 språk, och du kan lägga in innehåll på vilket som helst av dessa språk. Systemet översätter det automatiskt till alla övriga.
För flerspråkiga team förändrar detta samarbetet märkbart: produktledningen i Milano skriver skötselanvisningarna på italienska, inköpsavdelningen i Warszawa kompletterar materialuppgifterna på polska, kvalitetsavdelningen i Hamburg kontrollerar på tyska. Var och en arbetar på sitt eget språk, alla ser samma datauppsättning - och den som korrigerar en uppgift korrigerar den för alla språkversioner samtidigt.
Även här gäller begränsningen som nämnts ovan: När det gäller kritisk fackterminologi bör en människa i slutändan kontrollera vad maskinen har valt.
Verkligheten bakom EU:s språk
24 officiella EU-språk låter mycket. I praktiken finns det tre nivåer:
- Kärnmarknader: DE, EN, FR, IT, ES, NL - här förväntar sig varje konsument perfektion
- Betydande marknader: PT, PL, SV, DA, FI - bra nivå, ibland märker man att det är maskinöversatt
- Sällsynta språk: MT, GA, ET, LV, LT - ibland har man en DPP på maltesiska utan att någon slutkonsument på Malta någonsin läser den. Ändå är det obligatoriskt.
Kravet är inte valfritt. ESPR kräver att DPP-innehållet finns på språket i den medlemsstat där produkten säljs. Den som betjänar 27 stater har alltså 24 språk att ta hänsyn till (vissa delar språk).
Från maltesiska till bengaliska
Transpareo översätter till 40 språk - alla 24 officiella EU-språk och ytterligare 16 för global räckvidd:
- Europa: bulgariska, danska, tyska, engelska, estniska, finska, franska, grekiska, iriska, italienska, kroatiska, lettiska, litauiska, maltesiska, nederländska, polska, portugisiska, rumänska, svenska, slovakiska, slovenska, spanska, tjeckiska och ungerska - samt albanska, bosniska, isländska, makedonska, norska, ryska, serbiska, turkiska och ukrainska.
- Globalt: bengaliska, kinesiska, hindi, indonesiska, japanska, koreanska och vietnamesiska.
För det kommande textil-DPP:et täcks de stora produktionsländerna med bengaliska och vietnamesiska - en leverantör i Dhaka läser samma produktbeskrivning som en inköpare i Paris.
Varför ett centraliserat lokaliseringslager
De flesta plattformar lagrar översättningar som extra fält i dataposten: description_de, description_en, … 40 fält per översättningsbart attribut. Det låter enkelt, men har tre nackdelar:
- Dubbeltext. Två produkter med samma materialangivelse genererar 40 + 40 översättningar istället för 40 en gång
- Svårt att skala upp. Att lägga till ett 41:a språk innebär: schemamigrering över alla översättningsbara modeller
- Korrigeringar är svåra att tillämpa globalt. Om ”guarnizione” korrigeras överallt måste alla dataposter redigeras enskilt
Det delade översättningslagret löser detta: en post, många referenser. En korrigering, alla dataposter drar nytta av den.
Vad vi ännu inte har
En kundspecifik terminologidatabas med automatisk förslagsigenkänning finns med i utvecklingsplanen, men är ännu inte tillgänglig. Den som börjar idag kommer långt med de befintliga verktygen: manuella överskrivningar, import av ordlistor och markeringen ”bevara” täcker de vanligaste användningsfallen.
Vi anser att maskinerna bör sköta huvuddelen av arbetet och att människor endast ska ingripa där det verkligen behövs. Tills den automatiska terminologigenkänningen är tillgänglig är den manuella funktionen transparent - och det är ärligare än ett löfte som inte infrias.
