Machinale vertaling is tegenwoordig zo goed dat je deze in veel gevallen niet meer van menselijke vertalingen kunt onderscheiden. Vertaaldiensten werken vloeiend, idiomatisch en met gevoel voor stijl. Maar dan vertaal je een DPP-gegevensset - en plotseling wordt „rear lock fiber closure” ‘Hinterschloss-Faserverschluss’.
Het probleem heet vakterminologie. Hier leggen we uit waarom productgegevens niet als romans moeten worden behandeld en welke hulpmiddelen Transpareo ter beschikking stelt, zodat uw 40 taalversies begrijpelijk blijven.
Het fundamentele probleem: één woord, meerdere betekenissen
‘Seal’ in de DPP van een outdoorjas: afdichting. ‘Seal’ in een laboratorium: zeehond of afdichting, afhankelijk van de context. ‘Seal’ in een onderhoudsprotocol: in bepaalde gevallen een zegel.
Een algemeen vertaalmodel maakt een keuze op basis van de statistische context. Bij een vloeiende tekst werkt dat - de roman biedt voldoende context. Bij een gegevensveld primary_closure: seal is er nauwelijks context. Het model doet een gok.
Het gevolg zijn subtiele fouten. Niet zo dramatisch als ‘Hinterschloss-Faserverschluss’, maar wel met verstrekkende gevolgen: een onderdeel dat in het Duits ‘Dichtung’ wordt genoemd, heet in een Italiaans DPP plotseling ‘sigillo’ in plaats van ‘guarnizione’. Een inkoper kan het reserveonderdeel niet meer vinden.
Wat Transpareo vandaag de dag presteert
Ons vertaalsysteem zet elke nieuwe inhoud automatisch om naar alle actieve talen. Vier kenmerken kenmerken het:
-
Behoud van Markdown en variabelen: plaatshouders zoals
<a href="/nl/registreren">Pro-lidmaatschap</a>en Markdown-structuren worden vóór de vertaling geëxtraheerd, de pure tekst wordt vertaald en vervolgens worden de structuren ongewijzigd weer ingevoegd. Zo blijven links, formulieren en lay-out consistent in alle talen. - Centrale vertaalrecords: vertalingen worden niet in het record zelf opgeslagen, maar in een gedeelde laag. Meerdere records met dezelfde originele tekst delen één vertaling. Dit bespaart vertaalkosten en zorgt automatisch voor uniformiteit van termen in het hele datamodel.
- Automatische hervertaling bij wijzigingen: als de originele tekst wordt gewijzigd, worden de vertalingen in alle talen opnieuw gegenereerd. Een correctie in het Duits - 39 andere taalversies volgen automatisch.
- Markeringen per record: Inhoud kan worden uitgesloten van de automatische verwerking of bestaande vertalingen kunnen worden vastgelegd - bijvoorbeeld voor internationale productnamen of handmatige correcties.
Waar de klant de verwerking aanvult
De automatische vertaling levert grotendeels correcte resultaten op voor beschrijvingsteksten, marketingteksten en onderhoudsinstructies. Bij kritische vakterminologie - zoals ‘seal’/‘guarnizione’ - blijft er een resthoeveelheid fouten over die de beheerder van de klant moet corrigeren.
Hier heeft de beheerder drie mogelijkheden:
- Handmatig overschrijven per taal en sleutel: elk vertaalitem kan in de Applicatiebeheerder worden geopend en per taal worden aangepast. Met de markering ‘Vastleggen’ blijft deze handmatige vertaling behouden bij de volgende automatische vertaalrun.
- Import van een woordenlijst: Bestaande terminologie uit vertaaltools of PDF-woordenlijsten kan als CSV-bestand worden geïmporteerd en genereert direct geschreven vertaalvermeldingen.
- Correcties per taal tijdens het gebruik: een Italiaanse verkoopmedewerker merkt een fout op, corrigeert deze in de Application Manager - de correctie is onmiddellijk van kracht, de overige vertalingen blijven ongewijzigd.
De Application Manager ondersteunt dezelfde 40 talen
Niet alleen de productpasses zijn meertalig - ook de interface waarin u ze onderhoudt. De Application Manager is in alle 40 talen vertaald en u voert inhoud in elk van deze talen in. Het systeem vertaalt deze automatisch naar alle andere talen.
Voor meertalige teams verandert dit de samenwerking merkbaar: het productmanagement in Milaan schrijft de onderhoudsinstructies in het Italiaans, de inkoopafdeling in Warschau vult de materiaalgegevens aan in het Pools, de kwaliteitsborging in Hamburg controleert in het Duits. Iedereen werkt in zijn eigen taal, iedereen ziet dezelfde dataset - en wie een gegeven corrigeert, corrigeert het voor alle taalversies tegelijk.
Ook hier geldt de beperking van hierboven: bij kritieke vakterminologie moet uiteindelijk een mens controleren wat de machine heeft gekozen.
De realiteit van de EU-talen
24 officiële EU-talen klinkt als veel. In de praktijk zijn er drie niveaus:
- Kernmarkten: DE, EN, FR, IT, ES, NL - hier verwacht elke consument perfectie
- Belangrijke markten: PT, PL, SV, DA, FI - goed niveau, af en toe merk je de machine
- Zeldzame talen: MT, GA, ET, LV, LT - soms heb je een DPP in het Maltees, zonder dat er ooit een eindconsument in Malta de scan leest. Toch verplicht.
Deze verplichting is niet optioneel. De ESPR vereist DPP-inhoud in de taal van de lidstaat waar het product wordt verkocht. Wie 27 landen bedient, heeft dus te maken met 24 talen (sommige landen delen talen).
Van het Maltees tot het Bengaals
Transpareo vertaalt in 40 talen - alle 24 officiële EU-talen en 16 andere voor het wereldwijde bereik:
- Europa: Bulgaars, Deens, Duits, Engels, Ests, Fins, Frans, Grieks, Iers, Italiaans, Kroatisch, Lets, Litouws, Maltese, Nederlands, Pools, Portugees, Roemeens, Zweeds, Slowaaks, Sloveens, Spaans, Tsjechisch en Hongaars - plus Albanees, Bosnisch, IJslands, Macedonisch, Noors, Russisch, Servisch, Turks en Oekraïens.
- Wereldwijd: Bengaals, Chinees, Hindi, Indonesisch, Japans, Koreaans en Vietnamees.
Voor het komende textiel-DPP worden met Bengaals en Vietnamees de grote productielanden gedekt - een leverancier in Dhaka leest dezelfde productbeschrijving als een inkoper in Parijs.
Waarom een gecentraliseerde lokalisatielaag
De meeste platforms slaan vertalingen op als extra velden bij de gegevensset: description_de, description_en, … 40 velden per vertaalbaar attribuut. Klinkt eenvoudig, maar heeft drie nadelen:
- Dubbel opgeslagen tekst. Twee producten met dezelfde materiaalvermelding genereren 40 + 40 vertalingen in plaats van één keer 40
- Moeilijk schaalbaar. Een 41e taal toevoegen betekent: schemamigratie voor alle vertaalbare modellen
- Correcties zijn moeilijk globaal toe te passen. Als ‘guarnizione’ overal wordt gecorrigeerd, zouden alle gegevensrecords afzonderlijk moeten worden bewerkt
De gesplitste vertaallaag lost dit op: één vermelding, veel verwijzingen. Eén correctie, alle gegevensrecords profiteren ervan.
Wat we nog niet hebben
Een klantspecifieke terminologiedatabase met automatische herkenning van suggesties staat op de ontwikkelingsplanning, maar is op dit moment nog niet beschikbaar. Wie vandaag begint, komt met de bestaande tools al een heel eind: handmatig overschrijven, het importeren van woordenlijsten en de markering ‘vastleggen’ dekken de meest voorkomende gebruikssituaties.
Wij zijn van mening dat machines het grootste deel van het werk moeten doen en dat mensen alleen moeten ingrijpen waar dat echt nodig is. Totdat de automatische terminologieherkenning beschikbaar is, is de handmatige aanpak transparant - en dat is eerlijker dan een belofte die niet wordt nagekomen.
Vragen over dit artikel
In welke talen moet een productpas beschikbaar zijn?
De ESPR schrijft voor dat de inhoud van de bijsluiters in de taal van de lidstaat moet zijn waarin het product wordt verkocht. Wie aan de gehele Unie levert, heeft dus te maken met de 24 officiële EU-talen, waarvan sommige door meerdere lidstaten worden gedeeld. Transpareo levert deze 24 talen en nog 16 andere talen, en elke nieuwe of gewijzigde tekst wordt automatisch naar alle talen overgezet. In de praktijk betekent dit dat de taal geen uitgangspunt meer is - u schrijft één keer in de taal waarin u werkt, en de marktversies volgen vanzelf.
Wie is aansprakelijk wanneer een automatische vertaling een vakterm verkeerd weergeeft?
U. De verplichting om de inhoud van de bijsluiters correct weer te geven, rust op de marktdeelnemer die het product in de handel brengt, en deze verplichting gaat noch over op een vertaalsysteem, noch op ons. Daarom geven wij openlijk aan waar de machine wel en waar zij niet toereikend is - beschrijvingen, onderhoudsinstructies en marketingteksten komen foutloos uit de machine, terwijl gespecialiseerde termen zoals componentnamen, sluitingen of coatings een menselijk oog vereisen. Beschouw de automatische uitvoer als een volledig eerste concept in 40 talen en besteed de controletijd aan de paar honderd termen die voor reparatiebedrijven en kopers daadwerkelijk van belang zijn.
Hoe kan ik een term zodanig corrigeren dat deze bij de volgende automatische verwerking niet wordt overschreven?
Open het vertaalitem in de Applicatiebeheerder, pas de waarde voor de betreffende taal aan en vink het vakje ‘Vastleggen’ aan. Door dit vinkje te plaatsen, wordt het item uit de automatische verwerking gehaald, zodat het bij elke latere wijziging van de originele tekst behouden blijft. Zonder dit vinkje wordt uw correctie beschouwd als een gewone vertaling en wordt deze opnieuw gegenereerd zodra de originele tekst verandert. Voor een enkel woord geldt dezelfde tweestapsprocedure als voor een hele alinea.
Kunnen wij een bestaande terminologielijst importeren?
Ja. Terminologie die u toch al bijhoudt, of deze nu afkomstig is uit een vertaaltool of uit de PDF-woordenlijst van uw vertaalbureau, kan als CSV-bestand worden geïmporteerd en wordt vervolgens als geschreven vertaalitem opgeslagen. Deze items worden daarna behandeld als handmatige correcties. Het beste moment hiervoor is vóór de eerste grote import - dan zijn de termen al vastgelegd voordat duizenden gegevensrecords worden vertaald, en hoeft er achteraf niets meer te worden bijgewerkt.
Geldt een correctie voor alle producten of alleen voor het geopende gegevensrecord?
Voor elk gegevensrecord met dezelfde originele tekst. Vertalingen worden in een gedeelde laag opgeslagen in plaats van bij het afzonderlijke product; gegevensrecords met dezelfde tekst delen dus één vermelding, en een eenmalige correctie geldt voor alle records. Daarom neemt de correctie-inspanning ook niet toe naarmate de catalogus groeit - één term op 4000 producten is één vermelding, niet 4000.
Moeten collega’s in het buitenland in het Duits of in het Engels werken?
Nee. De applicatiemanager zelf is beschikbaar in alle 40 talen, en inhoud kan in elk van deze talen worden ingevoerd. Het productmanagement in Milaan schrijft de onderhoudsinstructies in het Italiaans, de inkoopafdeling in Warschau vult de materiaalgegevens aan in het Pools, en iedereen ziet hetzelfde gegevensrecord. Wie een gegeven corrigeert, corrigeert dit tegelijkertijd voor alle taalversies, waardoor de gebruikelijke omweg via een centraal vertaalbureau komt te vervallen.
Is er een automatische terminologieherkenning?
Vandaag niet. Een op maat gemaakte terminologiedatabase die zelfstandig termen voorstelt, staat op de ontwikkelingsplanning en is nog niet geleverd. Tot die tijd zijn de beschikbare opties het handmatig overschrijven, de markering ‘vastleggen’ en het importeren van een woordenlijst. Wij zeggen dit liever duidelijk, dan dat u plannen maakt op basis van een functie die nog niet bestaat. Voor de meeste gevallen volstaan deze drie hulpmiddelen, en het aantal termen dat u moet vastleggen is veel kleiner dan het aantal termen dat vertaald moet worden.




