如今机器翻译的水平已然如此之高,以至于在许多情况下已难以与人工翻译区分开来。翻译服务不仅行文流畅、符合习语,还能精准把握语体风格。然而,当翻译DPP数据集时 - - 原本的“rear lock fiber closure”却突然变成了变成了“后锁纤维封口”。
问题在于专业术语。本文将解释为何产品数据不能像小说那样处理,以及Transpareo提供了哪些工具,以确保您的40种语言版本保持清晰易懂。
根本问题:一个词,多种含义
户外夹克 DPP 中的“Seal”:密封。“Seal”在实验室中:根据上下文,可能是海豹或密封件。“Seal”在维护记录中:在某些情况下可能是印章。
通用翻译模型会根据统计语境进行选择。对于连贯的文本,这种方法可行 - - 小说提供了丰富的语境。但在数据字段primary_closure: seal中,几乎没有语境。模型只能进行推测。
这会导致一些细微的错误。虽然不像“Hinterschloss -Faserverschluss”那样严重,但后果不容小觑:一个在德语中被称为“Dichtung”的部件,在意大利语DPP中突然被译为“sigillo”而非“guarnizione”。 采购人员因此无法找到该备件。
Transpareo 当前的服务能力
我们的翻译系统会自动将所有新内容转换为所有活跃语言。该系统具有四大特点:
-保留 Markdown 和变量:在翻译前会提取 <a href="/zh/zhu-ce">Pro-Mitgliedschaft</a> 等占位符和 Markdown 结构,仅对纯文本进行翻译,随后将结构原样重新插入。这样,链接、表单和版式在所有语言中都能保持一致。
-集中式翻译条目:翻译内容不会存储在数据记录本身中,而是保存在一个共享层中。多个具有相同源文本的数据记录共享同一条翻译。这既节省了翻译成本,又能在整个数据模型中自动统一术语。
-修改后自动重新翻译: 若源文本发生变更,所有语言的译文将重新生成。德语版本的修正将自动同步到其他39种语言版本中。
-每条数据记录的标记:可以将内容从自动处理流程中排除,或锁定现有翻译 - - 例如针对国际产品名称或手动更正 ## 的情况。
客户补充处理的环节
对于描述性文本、营销文案和保养说明,自动翻译在很大程度上能提供正确的结果。但在关键专业术语方面 - - 例如 *“seal”/“guarnizione” - - *仍会存在少量错误,需要由客户的管理员进行修正。
在此情况下,管理员有三种处理方式:
- 按语言和关键词进行手动覆盖:可在应用程序管理器中打开每个翻译条目,并按语言进行调整。通过“锁定”标记,该手动翻译将在下次自动翻译运行时被保留。
- 术语表导入:可将翻译工具或PDF术语表中的现有术语以CSV格式导入,并直接生成相应的翻译条目。
- 运行中的按语言修正:意大利销售团队发现错误后,可在“应用程序管理器”中进行更正 - - 修正立即生效,其余翻译保持不变。
应用程序管理器支持相同的 40 种语言
不仅产品手册是多语言的,您用于维护这些手册的界面也是多语言的。 ## 应用程序管理器已翻译成全部 40 种语言,您可以使用其中任何一种语言录入内容,系统会自动将其翻译成所有其他语言。
对于多语言团队而言,这显著改变了协作方式:米兰的产品管理团队用意大利语编写保养说明,华沙的采购团队用波兰语补充材料数据,汉堡的质量保证团队则用德语进行审核。 每个人都使用自己的语言工作,所有人看到的都是同一套数据 - - 任何人对某项信息的更正,都会同时更新到所有语言版本中。
这里同样适用前文提到的限制:对于关键的专业术语,最终应由人工核查机器生成的译文。
欧盟语言的现实情况
24种欧盟官方语言听起来很多。实际上,它们分为三个层次:
-核心市场:DE、EN、FR、IT、ES、NL - - 这里的每位消费者都期待完美 -重要市场:PT、PL、SV、DA、FI - - 翻译质量良好,偶尔能察觉到机器翻译的痕迹 -冷门语言:MT、GA、ET、LV、LT - - 有时会生成马耳他语的《产品信息说明》(DPP),尽管马耳他本土的终端消费者根本不会阅读。但这仍是强制要求。
这一要求并非可选。ESPR规定,DPP内容必须使用产品销售所在成员国的语言。因此,面向27个成员国销售的企业,需涉及24种语言(部分国家共享同一语言)。
从马耳他语到孟加拉语
Transpareo 提供 40 种语言的翻译服务 - - 涵盖所有 24 种欧盟官方语言,以及 16 种其他语言以实现全球覆盖:
-欧洲:保加利亚语、丹麦语、德语、英语、爱沙尼亚语、芬兰语、法语、希腊语、爱尔兰语、意大利语、克罗地亚语、拉脱维亚语、立陶宛语、 马耳他语、荷兰语、波兰语、葡萄牙语、罗马尼亚语、瑞典语、斯洛伐克语、斯洛文尼亚语、西班牙语、捷克语和匈牙利语 - - 此外还有阿尔巴尼亚语、波斯尼亚语、 冰岛语、马其顿语、挪威语、俄语、塞尔维亚语、土耳其语和乌克兰语。 -全球范围:孟加拉语、汉语、印地语、印尼语、日语、韩语和越南语。
对于即将推出的纺织品 DPP 项目,孟加拉语和越南语的覆盖已涵盖主要生产国 - - 达卡的供应商与巴黎的采购员阅读的是同一份产品说明。
为何需要集中化的本地化层
大多数平台将翻译内容作为数据记录中的附加字段进行存储:description_de、description_en……每个可翻译属性对应 40 个字段。听起来很简单,但存在三个缺点:
- 文本重复存储。 两个具有相同材料说明的产品会产生 40 + 40 条翻译,而不是仅 40 条
- 难以扩展。添加第 41 种语言意味着:必须对所有可翻译的模型进行模式迁移
- 更正难以全局应用。 如果要修正 “guarnizione”一词,就必须逐一编辑所有数据记录
分离的翻译层解决了这个问题:一个条目,多个引用。一次修正,所有数据记录都受益。
我们目前还缺少什么
一个具备自动建议识别功能的客户专用术语数据库已列入开发计划,但目前尚未发布。现在开始使用的用户,借助现有工具就能走得很远:手动覆盖、术语表导入以及“保留”标记功能,已能覆盖最常见的使用场景。
我们认为,机器应承担大部分工作,而人类只需在真正必要时介入。在自动术语识别功能上线之前,手动操作流程是透明的 - - 这比无法兑现的承诺更诚实。
关于这篇帖子的提问
产品护照必须提供哪些语言版本?
《ESPR》要求产品说明书使用销售该产品的成员国的语言。面向整个欧盟供货的企业,需应对24种欧盟官方语言,其中部分语言由多个国家共用。 Transpareo 支持这 24 种语言以及另外 16 种语言,任何新增或修改的文本都会自动同步到所有语言版本中。实际上,这意味着语言不再是起始条件 - - 您只需用您惯用的语言撰写一次,各市场版本便会自动生成。
如果机器翻译未能准确处理一个专业术语,应由谁承担责任?
您。确保产品说明内容准确无误的责任在于将产品投放市场的经营者,这一责任既不会转移给翻译系统,也不会转移给我们。 因此,我们会坦率地说明机器能胜任哪些部分、无法胜任哪些部分 - - 产品描述、保养说明和营销文案能被准确处理,而诸如部件名称、锁扣或涂层等专业术语则需要人工审核。 请将自动生成的文本视为40种语言的完整初稿,并将审核时间集中在对维修商和买家真正重要的那几百个术语上。
如何修改一个术语,以确保下次自动运行时不会将其覆盖?
在“应用程序管理器”中打开翻译条目,调整相应语言的值,并勾选“锁定”选项。 勾选此选项可将该条目从自动处理流程中排除,从而确保其不受源文本后续更改的影响。若未勾选,您的修正将被视为常规翻译,一旦源文本发生更改,该翻译将重新生成。对于单个词,操作步骤与处理整个段落时相同,均需执行这两个步骤。
我们可以导入现有的术语表吗?
是的。无论您是通过翻译工具还是代理机构的PDF术语表来维护的术语,都可以以CSV格式导入,并作为已编写的翻译条目保存。此后,这些条目将按手动修改的方式处理。 进行此操作的最佳时机是在首次大规模导入之前 - - 这样,在翻译数千条数据记录之前,术语就已经就位,也就无需再进行后续处理了。
该更正会影响所有产品,还是仅影响已打开的数据集?
对于每个具有相同原始文本的数据条目。翻译内容存储在独立的层中,而非与具体产品绑定,因此文本相同的数据条目共享同一条记录,一次修正即可生效于所有条目。 因此,校对工作量也不会随产品目录规模的扩大而增加 - - 出现在4000种产品上的一个术语只需一个条目,而不是4000个。
在国外工作的同事们必须用德语还是英语工作?
不。应用程序管理器本身支持全部40种语言,且内容可在任意一种语言下录入。米兰的产品管理团队用意大利语编写保养说明,华沙的采购团队用波兰语补充材料数据,而所有人看到的都是同一套数据。 任何人对某项信息进行更正时,都会同时更新所有语言版本,从而省去了通常需要通过中央翻译部门进行转译的环节。
是否有自动术语识别功能?
今天还不行。一个能够主动建议术语的客户定制术语数据库目前尚在开发规划中,尚未发布。在此之前,可用的操作方式包括手动覆盖、标记保留以及导入术语表。 我们宁愿把这一点说清楚,也不愿让您根据一个尚不存在的功能来制定计划。对于常见的情况,这三种工具已经能够满足需求,而且您需要标记的术语数量远少于需要翻译的术语数量。




