40 Sprachen automatisch: wie unsere KI-Übersetzung mit Fachterminologie umgeht

40 Sprachen automatisch: wie unsere KI-Übersetzung mit Fachterminologie umgeht

Ein Blick hinter die Kulissen unserer automatischen Produktdaten-Übersetzung - und warum Fachterminologie anders behandelt werden muss als ein Romantext.

Maschinelle Übersetzung ist heute so gut, dass man sie in vielen Fällen nicht mehr von menschlicher unterscheidet. Übersetzungsdienste arbeiten fliessend, idiomatisch, mit Gefühl für Register. Dann übersetzt man einen DPP-Datensatz - und plötzlich wird aus «rear lock fiber closure» «Hinterschloss-Faserverschluss».

Das Problem heisst Fachterminologie. Hier erklären wir, warum Produktdaten nicht wie Romane zu behandeln sind und welche Werkzeuge Transpareo bereitstellt, damit Ihre 40 Sprachversionen verständlich bleiben.

Das Grundproblem: ein Wort, mehrere Bedeutungen

«Seal» im DPP einer Outdoor-Jacke: Abdichtung. «Seal» in einem Labor: Robbe oder Dichtung, je nach Kontext. «Seal» in einem Wartungsprotokoll: unter Umständen ein Siegel.

Ein allgemeines Übersetzungsmodell wählt anhand des statistischen Kontextes. Bei einem fliessenden Text funktioniert das - der Roman liefert reichlich Kontext. Bei einem Datenfeld primary_closure: seal gibt es kaum Kontext. Das Modell rät.

Ein Datenfeld liefert keinen Kontext, und ohne Kontext rät das Modell.

Die Folge sind subtile Fehler. Nicht so dramatisch wie «Hinterschloss-Faserverschluss», aber folgenreich: eine Komponente, die im Deutschen «Dichtung» genannt wird, heisst in einem italienischen DPP plötzlich «sigillo» statt «guarnizione». Ein Einkäufer findet das Ersatzteil nicht mehr.

Was Transpareo heute leistet

Unser Übersetzungssystem überträgt jeden neuen Inhalt automatisch in alle aktiven Sprachen. Vier Eigenschaften prägen es:

  • Markdown- und Variablen-Erhalt: Platzhalter wie <a href="/de/registrieren">Pro-Mitgliedschaft</a> und Markdown-Strukturen werden vor der Übersetzung extrahiert, der reine Text wird übersetzt, anschliessend werden die Strukturen unverändert wieder eingesetzt. So bleiben Links, Formulare und Layout konsistent über alle Sprachen hinweg.
  • Zentrale Übersetzungs-Einträge: Übersetzungen werden nicht im Datensatz selbst gespeichert, sondern in einer geteilten Schicht. Mehrere Datensätze mit gleichem Originaltext teilen sich eine Übersetzung. Das spart Übersetzungskosten und vereinheitlicht Begriffe automatisch über das Datenmodell hinweg.
  • Automatische Neu-Übersetzung bei Änderung: Wird der Originaltext geändert, werden die Übersetzungen in allen Sprachen neu erzeugt. Eine Korrektur auf Deutsch - 39 andere Sprachversionen folgen automatisch.
  • Markierungen pro Datensatz: Inhalte können vom automatischen Lauf ausgenommen oder bestehende Übersetzungen festgeschrieben werden - etwa für internationale Produktnamen oder manuelle Korrekturen.

Wo der Kunde die Verarbeitung ergänzt

Die automatische Übersetzung liefert grösstenteils richtige Ergebnisse für Beschreibungstexte, Marketingtexte und Pflegeanweisungen. Bei kritischer Fachterminologie - dem «seal»/«guarnizione» - bleibt eine Restmenge an Fehlern, die der Admin des Kunden korrigieren muss.

Hier hat der Admin drei Hebel:

  1. Manuelle Überschreibung pro Sprache und Schlüssel: Jeder Übersetzungs-Eintrag kann im Applikations-Manager geöffnet und je Sprache angepasst werden. Mit der Festhalten-Markierung bleibt diese manuelle Übersetzung beim nächsten automatischen Lauf erhalten.
  2. Glossar-Import: Bestehende Terminologien aus Übersetzer-Werkzeugen oder PDF-Glossaren lassen sich als CSV einspielen und erzeugen direkt geschriebene Übersetzungs-Einträge.
  3. Per-Sprache-Korrekturen im laufenden Betrieb: Ein italienischer Vertrieb merkt einen Fehler, korrigiert ihn im Applikations-Manager - die Korrektur ist sofort wirksam, die übrigen Übersetzungen bleiben unangetastet.

Der Applikations-Manager spricht dieselben 40 Sprachen

Nicht nur die Produktpässe sind mehrsprachig - auch die Oberfläche, in der Sie sie pflegen. Der Applikations-Manager ist in alle 40 Sprachen übersetzt, und Sie erfassen Inhalte in jeder dieser Sprachen. Das System übersetzt sie automatisch in alle anderen.

Für mehrsprachige Teams ändert das die Zusammenarbeit spürbar: Das Produktmanagement in Mailand schreibt die Pflegehinweise auf Italienisch, der Einkauf in Warschau ergänzt die Materialdaten auf Polnisch, die Qualitätssicherung in Hamburg prüft auf Deutsch.

Jede Person arbeitet in ihrer eigenen Sprache, alle sehen denselben Datensatz, und wer eine Angabe korrigiert, korrigiert sie für alle Sprachversionen zugleich.

Auch hier gilt die Einschränkung von oben: Bei kritischer Fachterminologie sollte am Ende ein Mensch prüfen, was die Maschine gewählt hat.

Die EU-Sprachen-Realität

24 EU-Amtssprachen klingt viel. In der Praxis sind es drei Schichten:

  • Kernmärkte: DE, EN, FR, IT, ES, NL - hier erwartet jeder Konsument Perfektion
  • Bedeutende Märkte: PT, PL, SV, DA, FI - gutes Niveau, gelegentlich merkt man die Maschine
  • Seltene Sprachen: MT, GA, ET, LV, LT - manchmal hat man einen DPP in maltesischer Sprache, ohne dass je ein Endkonsument in Malta scannt. Trotzdem Pflicht.

Die Pflicht ist nicht optional. Die ESPR fordert DPP-Inhalte in der Sprache des Mitgliedstaates, in dem das Produkt verkauft wird. Wer 27 Staaten bedient, hat also 24 Sprachen im Spiel (manche teilen Sprachen).

Von Maltesisch bis Bengalisch

Transpareo übersetzt in 40 Sprachen - alle 24 EU-Amtssprachen und 16 weitere für die globale Reichweite:

  • Europa: Bulgarisch, Dänisch, Deutsch, Englisch, Estnisch, Finnisch, Französisch, Griechisch, Irisch, Italienisch, Kroatisch, Lettisch, Litauisch, Maltesisch, Niederländisch, Polnisch, Portugiesisch, Rumänisch, Schwedisch, Slowakisch, Slowenisch, Spanisch, Tschechisch und Ungarisch - dazu Albanisch, Bosnisch, Isländisch, Mazedonisch, Norwegisch, Russisch, Serbisch, Türkisch und Ukrainisch.
  • Weltweit: Bengalisch, Chinesisch, Hindi, Indonesisch, Japanisch, Koreanisch und Vietnamesisch.

Für den kommenden Textil-DPP sind mit Bengalisch und Vietnamesisch die grossen Produktionsländer abgedeckt - ein Lieferant in Dhaka liest denselben Pass wie eine Einkäuferin in Paris.

Warum eine zentralisierte Lokalisierungs-Schicht

Die meisten Plattformen speichern Übersetzungen als zusätzliche Felder am Datensatz: description_de, description_en, … 40 Felder pro übersetzbarem Attribut. Klingt einfach, hat aber drei Nachteile:

  • Doppelt gehaltener Text. Zwei Produkte mit gleichem Material-Hinweis erzeugen 40 + 40 Übersetzungen statt einmal 40
  • Schwer skalierbar. Eine 41. Sprache hinzuzufügen heisst: Schema-Migration über alle übersetzbaren Modelle hinweg
  • Korrekturen schwer global anwendbar. Wird «guarnizione» überall korrigiert, müssten alle Datensätze einzeln bearbeitet werden

Die geteilte Übersetzungs-Schicht löst das: ein Eintrag, viele Referenzen. Eine Korrektur, alle Datensätze profitieren.

Was wir noch nicht haben

Eine kundenspezifische Terminologie-Datenbank mit automatischer Vorschlagserkennung steht in der Entwicklungsplanung, ist heute aber nicht ausgeliefert. Wer heute startet, kommt mit den vorhandenen Werkzeugen weit: manuelle Überschreibungen, Glossar-Importe und die Festhalten-Markierung decken die häufigsten Anwendungsfälle ab.

Wir glauben, dass Maschinen den Grossteil der Arbeit erledigen sollten und Menschen nur dort eingreifen, wo es wirklich nötig ist. Bis die automatische Terminologie-Erkennung verfügbar ist, ist der manuelle Hebel transparent - und das ist ehrlicher als ein Versprechen, das nicht eingelöst wird.

Fragen zu diesem Beitrag

In welchen Sprachen muss ein Produktpass vorliegen?

Die ESPR verlangt die Passinhalte in der Sprache des Mitgliedstaates, in dem das Produkt verkauft wird. Wer die ganze Union beliefert, hat damit die 24 EU-Amtssprachen im Spiel, von denen sich einige mehrere Staaten teilen. Transpareo liefert diese 24 und 16 weitere Sprachen aus, und jeder neue oder geänderte Text wird automatisch in alle übertragen. Praktisch heisst das, dass die Sprache kein Startkriterium mehr ist - Sie schreiben einmal in der Sprache, in der Sie arbeiten, und die Marktfassungen folgen.

Wer haftet, wenn eine maschinelle Übersetzung einen Fachbegriff verfehlt?

Sie. Die Pflicht, die Passinhalte richtig zu halten, liegt beim Wirtschaftsakteur, der das Produkt in Verkehr bringt, und sie geht weder auf ein Übersetzungssystem noch auf uns über. Deshalb sagen wir offen, wo die Maschine trägt und wo nicht - Beschreibungen, Pflegehinweise und Marketingtexte kommen sauber heraus, enge Fachbegriffe wie Komponentennamen, Verschlüsse oder Beschichtungen brauchen ein menschliches Auge. Behandeln Sie den automatischen Lauf als vollständigen Erstentwurf in 40 Sprachen und stecken Sie die Prüfzeit in die wenigen hundert Begriffe, an denen für Reparaturbetriebe und Käufer tatsächlich etwas hängt.

Wie korrigiere ich einen Begriff so, dass der nächste automatische Lauf ihn nicht überschreibt?

Öffnen Sie den Übersetzungs-Eintrag im Applikations-Manager, passen Sie den Wert für die betreffende Sprache an und setzen Sie die Festhalten-Markierung. Die Markierung nimmt den Eintrag aus dem automatischen Lauf heraus, sodass er jede spätere Änderung des Originaltextes übersteht. Ohne Markierung gilt Ihre Korrektur als gewöhnliche Übersetzung und wird neu erzeugt, sobald sich der Originaltext ändert. Für ein einzelnes Wort gilt derselbe Zweischritt wie für einen ganzen Absatz.

Können wir eine vorhandene Terminologieliste einspielen?

Ja. Terminologie, die Sie ohnehin pflegen, ob aus einem Übersetzer-Werkzeug oder aus dem PDF-Glossar Ihrer Agentur, lässt sich als CSV importieren und landet als geschriebener Übersetzungs-Eintrag. Diese Einträge verhalten sich danach wie manuelle Korrekturen. Der günstigste Zeitpunkt dafür liegt vor dem ersten grossen Import - dann stehen die Begriffe, bevor Tausende Datensätze übersetzt werden, und es bleibt nichts nachzuarbeiten.

Wirkt eine Korrektur für alle Produkte oder nur für den geöffneten Datensatz?

Für jeden Datensatz mit demselben Originaltext. Übersetzungen liegen in einer geteilten Schicht statt am einzelnen Produkt, gleichlautende Datensätze teilen sich also einen Eintrag, und eine einmalige Korrektur wirkt für alle. Deshalb wächst der Korrekturaufwand auch nicht mit dem Katalog - ein Begriff auf 4000 Produkten ist ein Eintrag, nicht 4000.

Müssen Kolleginnen und Kollegen im Ausland auf Deutsch oder Englisch arbeiten?

Nein. Der Applikations-Manager selbst liegt in allen 40 Sprachen vor, und Inhalte lassen sich in jeder davon erfassen. Das Produktmanagement in Mailand schreibt die Pflegehinweise auf Italienisch, der Einkauf in Warschau ergänzt die Materialdaten auf Polnisch, und alle sehen denselben Datensatz. Wer eine Angabe korrigiert, korrigiert sie für alle Sprachfassungen zugleich, womit die übliche Schleife über eine zentrale Übersetzungsstelle entfällt.

Gibt es eine automatische Terminologie-Erkennung?

Heute nicht. Eine kundenspezifische Terminologie-Datenbank, die Begriffe von sich aus vorschlägt, steht in der Entwicklungsplanung und ist nicht ausgeliefert. Die Hebel sind bis dahin die manuelle Überschreibung, die Festhalten-Markierung und der Glossar-Import. Das sagen wir lieber deutlich, als dass Sie mit einer Funktion planen, die es nicht gibt. Für die häufigen Fälle decken die drei Werkzeuge das Feld ab, und die Zahl der Begriffe, die Sie festhalten müssen, ist weit kleiner als die Zahl der Begriffe, die zu übersetzen sind.

Updates zu Mehrsprachigkeit und DPP-Praxis

Neue Sprachen, Datenqualität und Produktfunktionen - einmal im Monat kuratiert in Ihren Posteingang.