Maskinöversättning är idag så bra att man i många fall inte längre kan skilja den från mänsklig översättning. Översättningstjänsterna fungerar smidigt, idiomatiskt och med känsla för stil. Men när man översätter en DPP-datauppsättning blir plötsligt ”rear lock fiber closure” till ”Hinterschloss-Faserverschluss”.
Problemet heter fackterminologi. Här förklarar vi varför produktdata inte ska behandlas som romaner och vilka verktyg Transpareo tillhandahåller för att dina 40 språkversioner ska förbli begripliga.
Grundproblemet: ett ord, flera betydelser
”Seal” i DPP-data för en friluftsjacka: tätning. ”Seal” i ett laboratorium: säl eller tätning, beroende på sammanhanget. ”Seal” i ett underhållsprotokoll: under vissa omständigheter ett sigill.
En allmän översättningsmodell väljer utifrån det statistiska sammanhanget. I en flytande text fungerar det - romanen ger gott om sammanhang. I ett datafält primary_closure: seal finns det knappt något sammanhang. Modellen gissar.
Följden blir subtila fel. Inte lika dramatiska som ”Hinterschloss-Faserverschluss”, men med stora konsekvenser: en komponent som på tyska kallas ”Dichtung” heter plötsligt ”sigillo” istället för ”guarnizione” i ett italienskt DPP . En inköpare kan inte längre hitta reservdelen.
Vad Transpareo erbjuder idag
Vårt översättningssystem överför automatiskt allt nytt innehåll till alla aktiva språk. Det kännetecknas av fyra egenskaper:
-
Bevarande av Markdown och variabler: Platshållare som
<a href="/sv/registrera-sig">Pro-Mitgliedschaft</a>och Markdown-strukturer extraheras före översättningen, själva texten översätts och därefter återinsätts strukturerna oförändrade. På så sätt förblir länkar, formulär och layout konsekventa på alla språk. - Centrala översättningsposter: Översättningarna sparas inte i själva dataposten utan i ett gemensamt lager. Flera dataposter med samma originaltext delar på en översättning. Detta sparar översättningskostnader och standardiserar automatiskt termerna över hela datamodellen.
- Automatisk omöversättning vid ändring: Om originaltexten ändras genereras översättningarna på nytt i alla språk. En korrigering på tyska - 39 andra språkversioner följer automatiskt.
- Markeringar per datapost: Innehåll kan undantas från den automatiska processen eller befintliga översättningar kan låsas - till exempel för internationella produktnamn eller manuella korrigeringar.
Där kunden kompletterar bearbetningen
Den automatiska översättningen ger till största delen korrekta resultat för beskrivande texter, marknadsföringstexter och skötselanvisningar. När det gäller kritisk fackterminologi - som ”seal”/”guarnizione” - kvarstår en viss mängd fel som kundens administratör måste korrigera.
Här har administratören tre verktyg:
- Manuell överskrivning per språk och nyckel: Varje översättningspost kan öppnas i Applikationshanteraren och anpassas per språk. Med markeringen ”Lås” behålls denna manuella översättning vid nästa automatiska körning.
- Import av ordlista: Befintlig terminologi från översättningsverktyg eller PDF-ordlistor kan importeras som CSV-fil och genererar direkt skrivna översättningsposter.
- Språkspecifika korrigeringar under drift: En italiensk säljare upptäcker ett fel, korrigerar det i Applikationshanteraren - korrigeringen träder i kraft omedelbart, medan de övriga översättningarna förblir oförändrade.
Applikationshanteraren stöder samma 40 språk
Det är inte bara produktpasserna som är flerspråkiga - även gränssnittet där du underhåller dem. Applikationshanteraren är översatt till alla 40 språk, och du kan lägga in innehåll på vilket som helst av dessa språk. Systemet översätter det automatiskt till alla övriga.
För flerspråkiga team förändrar detta samarbetet märkbart: produktledningen i Milano skriver skötselanvisningarna på italienska, inköpsavdelningen i Warszawa kompletterar materialuppgifterna på polska, kvalitetsavdelningen i Hamburg kontrollerar på tyska. Var och en arbetar på sitt eget språk, alla ser samma datauppsättning - och den som korrigerar en uppgift korrigerar den för alla språkversioner samtidigt.
Även här gäller begränsningen som nämnts ovan: När det gäller kritisk fackterminologi bör en människa i slutändan kontrollera vad maskinen har valt.
Verkligheten bakom EU:s språk
24 officiella EU-språk låter mycket. I praktiken finns det tre nivåer:
- Kärnmarknader: DE, EN, FR, IT, ES, NL - här förväntar sig varje konsument perfektion
- Betydande marknader: PT, PL, SV, DA, FI - bra nivå, ibland märker man att det är maskinöversatt
- Sällsynta språk: MT, GA, ET, LV, LT - ibland har man en DPP på maltesiska utan att någon slutkonsument på Malta någonsin läser den. Ändå är det obligatoriskt.
Kravet är inte valfritt. ESPR kräver att DPP-innehållet finns på språket i den medlemsstat där produkten säljs. Den som betjänar 27 stater har alltså 24 språk att ta hänsyn till (vissa delar språk).
Från maltesiska till bengaliska
Transpareo översätter till 40 språk - alla 24 officiella EU-språk och ytterligare 16 för global räckvidd:
- Europa: bulgariska, danska, tyska, engelska, estniska, finska, franska, grekiska, iriska, italienska, kroatiska, lettiska, litauiska, maltesiska, nederländska, polska, portugisiska, rumänska, svenska, slovakiska, slovenska, spanska, tjeckiska och ungerska - samt albanska, bosniska, isländska, makedonska, norska, ryska, serbiska, turkiska och ukrainska.
- Globalt: bengaliska, kinesiska, hindi, indonesiska, japanska, koreanska och vietnamesiska.
För det kommande textil-DPP:et täcks de stora produktionsländerna med bengaliska och vietnamesiska - en leverantör i Dhaka läser samma produktbeskrivning som en inköpare i Paris.
Varför ett centraliserat lokaliseringslager
De flesta plattformar lagrar översättningar som extra fält i dataposten: description_de, description_en, … 40 fält per översättningsbart attribut. Det låter enkelt, men har tre nackdelar:
- Dubbeltext. Två produkter med samma materialangivelse genererar 40 + 40 översättningar istället för 40 en gång
- Svårt att skala upp. Att lägga till ett 41:a språk innebär: schemamigrering över alla översättningsbara modeller
- Korrigeringar är svåra att tillämpa globalt. Om ”guarnizione” korrigeras överallt måste alla dataposter redigeras enskilt
Det delade översättningslagret löser detta: en post, många referenser. En korrigering, alla dataposter drar nytta av den.
Vad vi ännu inte har
En kundspecifik terminologidatabas med automatisk förslagsigenkänning finns med i utvecklingsplanen, men är ännu inte tillgänglig. Den som börjar idag kommer långt med de befintliga verktygen: manuella överskrivningar, import av ordlistor och markeringen ”bevara” täcker de vanligaste användningsfallen.
Vi anser att maskinerna bör sköta huvuddelen av arbetet och att människor endast ska ingripa där det verkligen behövs. Tills den automatiska terminologigenkänningen är tillgänglig är den manuella funktionen transparent - och det är ärligare än ett löfte som inte infrias.
Frågor om detta inlägg
På vilka språk måste ett produktpass finnas tillgängligt?
ESPR kräver att innehållet i produktinformationen ska vara på det språk som används i den medlemsstat där produkten säljs. Den som levererar till hela unionen måste därför ta hänsyn till de 24 officiella EU-språken, varav vissa delas av flera stater. Transpareo tillhandahåller dessa 24 språk samt ytterligare 16, och varje ny eller ändrad text överförs automatiskt till alla språk. I praktiken innebär detta att språket inte längre är ett utgångskriterium - du skriver en gång på det språk du arbetar med, och marknadsversionerna följer automatiskt.
Vem bär ansvaret om en maskinöversättning missar ett fackuttryck?
Ni. Ansvaret för att innehållet i bruksanvisningen är korrekt ligger hos den ekonomiska aktör som släpper ut produkten på marknaden, och det övergår varken till ett översättningssystem eller till oss. Därför säger vi öppet var maskinen klarar sig och var inte - beskrivningar, skötselråd och marknadsföringstexter blir felfria, medan snäva facktermer som komponentnamn, förslutningar eller beläggningar kräver ett mänskligt öga. Betrakta den automatiska översättningen som ett fullständigt första utkast på 40 språk och lägg granskningstiden på de några hundra termer som verkligen är avgörande för reparationsverkstäder och köpare.
Hur korrigerar jag ett begrepp så att nästa automatiska körning inte skriver över det?
Öppna översättningsposten i Applikationshanteraren, justera värdet för det aktuella språket och markera rutan för att spara ändringen. Markeringen tar bort posten från den automatiska körningen, så att den bevaras även om originaltexten ändras senare. Utan markering betraktas din korrigering som en vanlig översättning och genereras på nytt så snart originaltexten ändras. För ett enskilt ord gäller samma tvåstegsprocess som för ett helt stycke.
Kan vi importera en befintlig terminologilista?
Ja. Terminologi som ni ändå underhåller, oavsett om den kommer från ett översättningsverktyg eller från er byrås PDF-ordlista, kan importeras som CSV-fil och hamnar som en skriven översättningspost. Dessa poster behandlas därefter som manuella korrigeringar. Det bästa tillfället för detta är före den första stora importen - då finns termerna på plats innan tusentals dataposter översätts, och det blir inget kvar att efterbearbeta.
Gäller korrigeringen för alla produkter eller endast för den öppna dataposten?
För varje datapost med samma originaltext. Översättningarna finns i ett gemensamt lager istället för vid den enskilda produkten, vilket innebär att identiska dataposter delar på en post, och en engångskorrigering gäller för alla. Därför ökar inte heller korrigeringsarbetet i takt med katalogen - ett begrepp som förekommer på 4 000 produkter motsvarar en post, inte 4 000.
Måste kollegor utomlands arbeta på tyska eller engelska?
Nej. Applikationshanteraren finns i alla 40 språk, och innehåll kan läggas in på vart och ett av dem. Produktledningen i Milano skriver skötselanvisningarna på italienska, inköpsavdelningen i Warszawa kompletterar materialuppgifterna på polska, och alla ser samma datauppsättning. Den som korrigerar en uppgift korrigerar den för alla språkversioner samtidigt, vilket innebär att den vanliga processen via en central översättningsenhet inte längre behövs.
Finns det någon automatisk terminologiigenkänning?
Inte idag. En kundspecifik terminologidatabas som självständigt föreslår termer finns med i utvecklingsplanen men har ännu inte släppts. Tills dess är de tillgängliga verktygen manuell överskrivning, markering för bevarande och import av ordlista. Vi vill hellre säga detta tydligt än att ni planerar utifrån en funktion som inte finns. För de vanligaste fallen täcker dessa tre verktyg behoven, och antalet termer som ni måste markera är betydligt mindre än antalet termer som ska översättas.




