Днес машиният превод е толкова добър, че в много случаи вече не може да се различи от човешкия. Преводаческите услуги работят плавно, идиоматично и с чувство за стил. Но когато се превежда набор от данни DPP - изведнъж „rear lock fiber closure“ „задна фиброви затвор“.
Проблемът се нарича специализирана терминология. Тук обясняваме защо данните за продуктите не трябва да се третират като романи и какви инструменти предоставя Transpareo, за да останат вашите 40 езикови версии разбираеми.
Основният проблем: една дума, няколко значения
„Seal“ в DPP на яке за активен отдих: уплътнение. „Seal“ в лаборатория: тюлен или уплътнение, в зависимост от контекста. „Seal“ в протокол за поддръжка: при определени обстоятелства - печат.
Един общ преводачески модел избира въз основа на статистическия контекст. При плавен текст това работи - романът предоставя изобилие от контекст. При поле с данни primary_closure: seal контекст почти няма. Моделът прави предположение.
Резултатът са фини грешки. Не толкова драматични като „затваряне отзад с влакнесто затваряне“, но с сериозни последствия: компонент, който на немски се нарича „Dichtung“, в италиански DPP изведнъж се нарича „sigillo“ вместо „guarnizione“. Един закупчик вече не може да намери резервната част.
Какво предлага Transpareo днес
Нашата система за превод автоматично превежда всеки нов съдържание във всички активни езици. Тя се характеризира с четири основни свойства:
-
Запазване на Markdown и променливи: заместващите символи като
<a href="/bg/rieghistriram-sie">Pro-Mitgliedschaft</a>и Markdown-структурите се извличат преди превода, превежда се само чистият текст, а след това структурите се вмъкват отново без промени. По този начин линковете, формулярите и оформлението остават последователни във всички езици. - Централизирани преводни записи: Преводите не се съхраняват в самия запис, а в споделен слой. Няколко записи с един и същ оригинален текст споделят един превод. Това спестява разходи за превод и автоматично унифицира терминологията в целия модел на данните.
- Автоматично преизчисляване при промяна: Ако оригиналният текст бъде променен, преводите във всички езици се генерират наново. Една корекция на немски - 39 други езикови версии следват автоматично.
- Маркировки за всеки запис: Съдържанието може да бъде изключено от автоматичния цикъл или съществуващите преводи да бъдат фиксирани - например за международни имена на продукти или ръчни корекции.
Където клиентът допълва обработката
Автоматичният превод предоставя предимно правилни резултати за описателни текстове, маркетингови текстове и инструкции за поддръжка. При критична специализирана терминология - например „seal“/„guarnizione“ - остава известно количество грешки, които администраторът на клиента трябва да коригира.
Тук администраторът разполага с три възможности:
- Ръчно презаписване за всеки език и ключ: Всеки преводачески запис може да бъде отворен в Application Manager и адаптиран за всеки език. С отбелязването за фиксиране този ръчен превод се запазва при следващия автоматичен цикъл.
- Импортиране на речник: Съществуващата терминология от преводачески инструменти или PDF-речници може да се импортира като CSV файл и да генерира директно въведени преводни записи.
- Корекции по езици по време на работа: Италианският отдел по продажбите забелязва грешка, коригира я в Application Manager - корекцията влиза в сила незабавно, а останалите преводи остават непроменени.
Application Manager поддържа същите 40 езика
Не само продуктовите спецификации са многоезични - същото важи и за интерфейса, в който ги поддържате. Application Manager е преведен на всички 40 езика и можете да въвеждате съдържание на всеки от тях. Системата го превежда автоматично на всички останали.
За многоезичните екипи това променя съществено сътрудничеството: отделът за управление на продуктите в Милано изготвя инструкциите за поддръжка на италиански, отделът за снабдяване във Варшава допълва данните за материалите на полски, а отделът за осигуряване на качеството в Хамбург извършва проверката на немски. Всеки работи на собствения си език, всички виждат един и същ набор от данни - и когато някой коригира дадена информация, тя се коригира едновременно за всички езикови версии.
И тук важи ограничението, споменато по-горе: при критична специализирана терминология в крайна сметка човек трябва да провери какво е избрала машината.
Реалността с езиците на ЕС
24 официални езика на ЕС звучат като много. На практика те се разделят на три групи:
- Основни пазари: DE, EN, FR, IT, ES, NL - тук всеки потребител очаква съвършенство
- Значими пазари: PT, PL, SV, DA, FI - добро ниво, понякога се забелязва, че преводът е машинно генериран
- Редки езици: MT, GA, ET, LV, LT - понякога имате DPP на малтийски език, без нито един краен потребител в Малта да го сканира. Въпреки това това е задължително.
Това изискване не е по избор. Наредбата за защита на потребителите (ESPR) изисква съдържанието на DPP да бъде на езика на държавата-членка, в която се продава продуктът. Който обслужва 27 държави, трябва да се съобразява с 24 езика (някои държави споделят езици).
От малтийски до бенгалски
Transpareo превежда на 40 езика - всички 24 официални езика на ЕС и още 16 за глобално покритие:
- Европа: български, датски, немски, английски, естонски, фински, френски, гръцки, ирландски, италиански, хърватски, латвийски, литовски, малтийски, нидерландски, полски, португалски, румънски, шведски, словашки, словенски, испански, чешки и унгарски - както и албански, босненски, исландски, македонски, норвежки, руски, сръбски, турски и украински.
- По целия свят: бенгалски, китайски, хинди, индонезийски, японски, корейски и виетнамски.
За предстоящия DPP за текстил с бенгалски и виетнамски са обхванати големите производствени страни - доставчик в Дака чете същия паспорт като купувач в Париж.
Защо е необходим централизиран слой за локализация
Повечето платформи съхраняват преводите като допълнителни полета в записите: description_de, description_en, … 40 полета за всеки преводим атрибут. Звучи просто, но има три недостатъка:
- Дублиран текст. Два продукта с една и съща информация за материала генерират 40 + 40 превода, вместо само 40
- Трудно мащабируемо. Добавянето на 41-ви език означава: миграция на схемата за всички модели, подлежащи на превод
- Трудно е да се приложат корекциите глобално. Ако „guarnizione“ се коригира навсякъде, всички записи трябва да се редактират поотделно
Разделеният преводачески слой решава този проблем: един запис, много препратки. Една корекция, от която се възползват всички записи.
Какво все още ни липсва
Клиентска терминологична база данни с автоматично разпознаване на предложения е в плана за разработка, но към момента не е налична. Който започне днес, ще стигне далеч с наличните инструменти: ръчно презаписване, импортиране на речници и маркирането за запазване покриват най-често срещаните случаи на употреба.
Вярваме, че машините трябва да извършват по-голямата част от работата, а хората да се намесват само там, където е наистина необходимо. Докато автоматичното разпознаване на терминологията не е налице, ръчното управление е прозрачно - и това е по-честно от обещание, което не се изпълнява.
Въпроси относно тази публикация
На кои езици трябва да бъде изготвен паспортът на продукта?
ESPR изисква текстовете на етикетите да бъдат на езика на държавата-членка, в която се продава продуктът. Който доставя в целия Съюз, трябва да се съобразява с 24-те официални езика на ЕС, като някои от тях се използват в няколко държави. Transpareo предоставя тези 24 езика, както и още 16, а всеки нов или променен текст автоматично се превежда на всички тях. На практика това означава, че езикът вече не е изходен критерий - пишете веднъж на езика, на който работите, и версиите за различните пазари следват автоматично.
Кой носи отговорност, ако при машинен превод е допусната грешка в термина?
Вие. Задължението за точност на съдържанието на етикетите лежи върху икономическия субект, който пуска продукта на пазара, и то не се прехвърля нито върху система за превод, нито върху нас. Ето защо ние откровено посочваме къде машината се справя добре и къде не - описанията, указанията за поддръжка и маркетинговите текстове се превеждат безпроблемно, докато специфичните термини като наименования на компоненти, затварящи механизми или покрития изискват човешко око. Разглеждайте автоматичния превод като пълен първоначален вариант на 40 езика и отделете времето за проверка на онези няколкостотин термина, от които наистина зависи нещо за сервизните центрове и купувачите.
Как да коригирам даден термин, така че следващото автоматично изпълнение да не го замени?
Отворете записа за превода в Мениджъра на приложенията, коригирайте стойността за съответния език и поставете отметката „Запази“. Отбелязването изключва записа от автоматичния цикъл, така че той да остане непроменен при всяка последваща промяна на оригиналния текст. Без отбелязване вашата корекция се счита за обикновен превод и се генерира наново, веднага щом оригиналният текст се промени. За една дума се прилага същата двустъпкова процедура, както и за цял параграф.
Можем ли да импортираме съществуващ терминологичен списък?
Да. Терминологията, която и без друго поддържате - било то от преводачески инструмент или от PDF-речника на вашата агенция - може да се импортира като CSV файл и се превръща в записан преводачески запис. След това тези записи се третират като ръчни корекции. Най-подходящият момент за това е преди първия голям импорт - тогава термините са налице, преди да бъдат преведени хиляди записи, и не остава нищо за довършване.
Корекцията важи ли за всички продукти или само за отворения запис?
За всеки запис със същия оригинален текст. Преводите се съхраняват в отделен слой, а не към отделния продукт, така че записите с еднакъв текст споделят един и същ запис, и една единствена корекция важи за всички. Ето защо усилието за корекция не нараства пропорционално с размера на каталога - един термин, приложен към 4000 продукта, представлява един запис, а не 4000.
Трябва ли колегите в чужбина да работят на немски или на английски?
Не. Самият мениджър на приложенията е достъпен на всички 40 езика, а съдържанието може да се въвежда на всеки от тях. Отделът за управление на продуктите в Милано изготвя инструкциите за поддръжка на италиански, отделът за снабдяване във Варшава допълва данните за материалите на полски, а всички виждат един и същ набор от данни. Който коригира дадена информация, я коригира едновременно за всички езикови версии, като по този начин се премахва обичайният цикъл през централен преводачески център.
Има ли автоматично разпознаване на терминологията?
Днес - не. В плана за разработка е включена специфична за клиента терминологична база данни, която сама предлага термини, но тя все още не е пусната в употреба. Дотогава основните инструменти са ръчното презаписване, маркирането за запазване и импортирането на речник. Предпочитаме да го кажем ясно, за да не планирате работата си въз основа на функция, която все още не съществува. За повечето случаи тези три инструмента покриват нуждите, а броят на термините, които трябва да маркирате, е много по-малък от броя на термините, които трябва да бъдат преведени.




