Maskinoversettelse er i dag så god at man i mange tilfeller ikke lenger kan skille den fra menneskelig oversettelse. Oversettelsestjenestene leverer flytende, idiomatiske oversettelser med sans for språklig stil. Så oversetter man et DPP-datasett - og plutselig blir «rear lock fiber closure» til «Hinterschloss-Faserverschluss».
Problemet heter fagterminologi. Her forklarer vi hvorfor produktdata ikke skal behandles som romaner, og hvilke verktøy Transpareo stiller til rådighet for at de 40 språkversjonene dine skal forbli forståelige.
Grunnproblemet: ett ord, flere betydninger
«Seal» i DPP-dataene til en friluftsjakke: tetning. «Seal» i et laboratorium: sel eller tetning, avhengig av konteksten. «Seal» i en vedlikeholdsprotokoll: under visse omstendigheter et segl.
En generell oversettelsesmodell velger ut fra den statistiske konteksten. I en flytende tekst fungerer dette - romanen gir rikelig med kontekst. I et datafelt primary_closure: seal er det knapt noen kontekst. Modellen må gjette.
Resultatet blir subtile feil. Ikke så dramatiske som «Hinterschloss-Faserverschluss», men med store konsekvenser: en komponent som på tysk kalles «Dichtung», heter plutselig «sigillo» i stedet for «guarnizione» i en italiensk DPP . En innkjøper finner ikke lenger reservedelen.
Hva Transpareo tilbyr i dag
Vårt oversettelsessystem overfører alt nytt innhold automatisk til alle aktive språk. Fire egenskaper kjennetegner det:
-
Bevaring av Markdown og variabler: Plassholdere som
<a href="/nb/registrere-seg">Pro-Mitgliedschaft</a>og Markdown-strukturer blir ekstrahert før oversettelsen, selve teksten blir oversatt, og deretter settes strukturene inn igjen uendret. Slik forblir lenker, skjemaer og layout konsistente på tvers av alle språk. - Sentrale oversettelsesoppføringer: Oversettelsene lagres ikke i selve dataposten, men i et delt lag. Flere dataposter med samme originaltekst deler én oversettelse. Dette sparer oversettelseskostnader og standardiserer begrepene automatisk på tvers av datamodellen.
- Automatisk ny oversettelse ved endring: Hvis originalteksten endres, genereres oversettelsene på nytt i alle språk. En rettelse på tysk - 39 andre språkversjoner følger automatisk.
- Merkinger per datapost: Innhold kan unntas fra den automatiske prosessen, eller eksisterende oversettelser kan låses - for eksempel for internasjonale produktnavn eller manuelle rettelser.
Der kunden supplerer behandlingen
Den automatiske oversettelsen gir for det meste korrekte resultater for beskrivende tekster, markedsføringstekster og vedlikeholdsanvisninger. Når det gjelder kritisk fagterminologi - «seal»/«guarnizione» - gjenstår det en restmengde feil som kundens administrator må korrigere.
Her har administratoren tre muligheter:
- Manuell overskriving per språk og nøkkel: Hver oversettelsesoppføring kan åpnes i Applikasjonsadministratoren og tilpasses for hvert språk. Med «Lås»-merket beholdes denne manuelle oversettelsen ved neste automatiske oversettelsesrunde.
- Import av ordliste: Eksisterende terminologi fra oversettelsesverktøy eller PDF-ordlister kan importeres som CSV-fil og genererer direkte skrevne oversettelsesoppføringer.
- Korrigeringer per språk under drift: En italiensk salgsavdeling oppdager en feil, korrigerer den i Applikasjonsbehandleren - korrigeringen trer i kraft umiddelbart, mens de øvrige oversettelsene forblir uendret.
Applikasjonsbehandleren støtter de samme 40 språkene
Ikke bare produktpassene er flerspråklige - det samme gjelder grensesnittet der du vedlikeholder dem. Applikasjonsbehandleren er oversatt til alle 40 språkene, og du kan legge inn innhold på hvilket som helst av disse språkene. Systemet oversetter det automatisk til alle de andre.
For flerspråklige team endrer dette samarbeidet merkbart: Produktledelsen i Milano skriver vedlikeholdsanvisningene på italiensk, innkjøpsavdelingen i Warszawa legger til materialdataene på polsk, og kvalitetssikringen i Hamburg kontrollerer på tysk. Hver person jobber på sitt eget språk, alle ser det samme datasettet - og den som korrigerer en opplysning, korrigerer den for alle språkversjonene samtidig.
Også her gjelder begrensningen nevnt ovenfor: Når det gjelder kritisk fagterminologi, bør et menneske til slutt kontrollere hva maskinen har valgt.
Realiteten rundt EU-språkene
24 offisielle EU-språk høres ut som mye. I praksis er det tre nivåer:
- Kjerneområder: DE, EN, FR, IT, ES, NL - her forventer alle forbrukere perfeksjon
- Viktige markeder: PT, PL, SV, DA, FI - godt nivå, av og til merker man at det er maskinoversatt
- Sjeldne språk: MT, GA, ET, LV, LT - noen ganger har man en DPP på maltesisk uten at en eneste sluttbruker på Malta noensinne skanner den. Likevel er det obligatorisk.
Kravet er ikke valgfritt. ESPR krever DPP-innhold på språket i den medlemsstaten der produktet selges. Den som betjener 27 stater, har altså 24 språk å forholde seg til (noen deler språk).
Fra maltesisk til bengalsk
Transpareo oversetter til 40 språk - alle de 24 offisielle EU-språkene og 16 til for global rekkevidde:
- Europa: bulgarsk, dansk, tysk, engelsk, estisk, finsk, fransk, gresk, irsk, italiensk, kroatisk, lettisk, litauisk, maltesisk, nederlandsk, polsk, portugisisk, rumensk, svensk, slovakisk, slovensk, spansk, tsjekkisk og ungarsk - i tillegg albansk, bosnisk, islandsk, makedonsk, norsk, russisk, serbisk, tyrkisk og ukrainsk.
- Globalt: bengalsk, kinesisk, hindi, indonesisk, japansk, koreansk og vietnamesisk.
For den kommende tekstil-DPP-en er de store produksjonslandene dekket med bengalsk og vietnamesisk - en leverandør i Dhaka leser den samme passbeskrivelsen som en innkjøper i Paris.
Hvorfor et sentralisert lokaliseringslag
De fleste plattformer lagrer oversettelser som ekstra felt i datasettet: description_de, description_en, … 40 felt per oversettbart attributt. Det høres enkelt ut, men har tre ulemper:
- Tekst som lagres to ganger. To produkter med samme materialbeskrivelse genererer 40 + 40 oversettelser i stedet for én gang 40
- Vanskelig å skalere. Å legge til et 41. språk innebærer: skjemamigrering på tvers av alle oversettbare modeller
- Korrigeringer er vanskelige å anvende globalt. Hvis «guarnizione» korrigeres overalt, må alle dataposter redigeres hver for seg
Det delte oversettelseslaget løser dette: én oppføring, mange referanser. Én korreksjon, alle dataposter drar nytte av det.
Det vi ikke har ennå
En kundespesifikk terminologidatabase med automatisk gjenkjenning av forslag er under utvikling, men er foreløpig ikke tilgjengelig. De som starter i dag, kommer langt med de eksisterende verktøyene: manuell overskriving, import av ordlister og «hold fast»-markeringen dekker de vanligste bruksområdene.
Vi mener at maskiner bør utføre størstedelen av arbeidet, og at mennesker bare bør gripe inn der det virkelig er nødvendig. Inntil den automatiske terminologigjenkjenningen er tilgjengelig, er den manuelle løsningen transparent - og det er mer ærlig enn et løfte som ikke innfris.
Spørsmål om dette innlegget
På hvilke språk må et produktpass foreligge?
ESPR krever at innholdet i passet skal være på språket i den medlemsstaten der produktet selges. De som leverer til hele Unionen, må derfor ta hensyn til de 24 offisielle EU-språkene, hvorav noen deles av flere stater. Transpareo leverer disse 24 språkene samt 16 andre, og hver ny eller endret tekst overføres automatisk til alle. I praksis betyr dette at språket ikke lenger er et utgangspunkt - du skriver én gang på det språket du jobber på, og markedsversjonene følger etter.
Hvem er ansvarlig hvis en maskinell oversettelse ikke gjengir et faguttrykk riktig?
Det er den økonomiske aktøren som bringer produktet i omløp som har ansvaret for at passasjene er korrekte, og dette ansvaret overføres verken til et oversettelsessystem eller til oss. Derfor sier vi åpent hvor maskinen fungerer og hvor den ikke gjør det - beskrivelser, pleieanvisninger og markedsføringstekster blir korrekte, mens spesialiserte faguttrykk som komponentnavn, lukkinger eller belegg krever et menneskelig øye. Behandle den automatiske oversettelsen som et fullstendig førsteutkast på 40 språk, og bruk kontrolltiden på de få hundre begrepene som faktisk har betydning for reparasjonsverksteder og kjøpere.
Hvordan retter jeg et begrep slik at det ikke blir overskrevet ved neste automatiske kjøring?
Åpne oversettelsesoppføringen i Applikasjonsbehandleren, juster verdien for det aktuelle språket og sett «Bevar»-merket. Denne markeringen ekskluderer oppføringen fra den automatiske kjøringen, slik at den forblir uendret selv om originalteksten endres senere. Uten markering regnes korreksjonen din som en vanlig oversettelse og genereres på nytt så snart originalteksten endres. For et enkelt ord gjelder den samme to-trinnsprosessen som for et helt avsnitt.
Kan vi importere en eksisterende terminologiliste?
Ja. Terminologi som du uansett vedlikeholder, enten fra et oversettelsesverktøy eller fra byråets PDF-ordliste, kan importeres som CSV-fil og blir deretter lagret som en skriftlig oversettelsesoppføring. Disse oppføringene behandles deretter som manuelle rettelser. Det beste tidspunktet for dette er før den første store importen - da er begrepene på plass før tusenvis av dataposter oversettes, og det blir ikke noe å etterarbeide.
Gjelder en endring for alle produktene eller bare for den åpne posten?
For hvert datasett med samme originaltekst. Oversettelsene ligger i et felles lag i stedet for på det enkelte produktet, så identiske datasett deler dermed én oppføring, og en enkelt rettelse gjelder for alle. Derfor øker ikke korrigeringsarbeidet i takt med katalogen - et begrep på 4000 produkter utgjør én oppføring, ikke 4000.
Må kolleger i utlandet jobbe på tysk eller engelsk?
Nei. Selve applikasjonsbehandleren finnes på alle 40 språk, og innhold kan legges inn på hvert av dem. Produktledelsen i Milano skriver vedlikeholdsanvisningene på italiensk, innkjøpsavdelingen i Warszawa legger til materialdataene på polsk, og alle ser det samme datasettet. Den som korrigerer en opplysning, korrigerer den for alle språkversjonene samtidig, noe som gjør den vanlige prosessen via et sentralt oversettelsesbyrå overflødig.
Finnes det automatisk terminologigjenkjenning?
Ikke i dag. En kundespesifikk terminologidatabase som selv foreslår begreper, er under utvikling og er ikke tilgjengelig ennå. Inntil da er løsningene manuell overskriving, «hold fast»-markering og import av ordlister. Vi sier dette hellere tydelig, enn at du planlegger med en funksjon som ikke finnes. For de vanligste tilfellene dekker disse tre verktøyene behovet, og antallet begreper du må merke er langt mindre enn antallet begreper som skal oversettes.




