Terjemahan mesin saat ini sudah begitu baik sehingga dalam banyak kasus tidak lagi dapat dibedakan dari terjemahan manusia. Layanan terjemahan ini menghasilkan teks yang lancar, menggunakan ungkapan-ungkapan idiomatik, serta peka terhadap gaya bahasa. Namun, ketika menerjemahkan satu set data DPP - tiba-tiba frasa “rear lock fiber closure” menjadi “penutup serat bagian belakang”.
Masalahnya terletak pada terminologi teknis. Di sini kami menjelaskan mengapa data produk tidak boleh diperlakukan seperti novel, serta alat apa saja yang disediakan Transpareo agar 40 versi bahasa Anda tetap mudah dipahami.
Masalah dasarnya: satu kata, banyak arti
“Seal” dalam DPP jaket outdoor: penyegelan. “Seal” di laboratorium: anjing laut atau segel, tergantung konteksnya. “Seal” dalam protokol pemeliharaan: dalam kondisi tertentu, bisa berarti stempel.
Model terjemahan umum memilih berdasarkan konteks statistik. Hal ini berfungsi pada teks yang mengalir - novel menyediakan konteks yang melimpah. Namun, pada bidang data primary_closure: seal, konteksnya sangat minim. Model tersebut hanya menebak.
Akibatnya adalah kesalahan-kesalahan halus. Tidak sedramatis “Hinterschloss-Faserverschluss”, tetapi berdampak besar: sebuah komponen yang dalam bahasa Jerman disebut “Dichtung”, tiba-tiba dalam DPP bahasa Italia disebut “sigillo” alih-alih “guarnizione”. Seorang pembeli tidak dapat lagi menemukan suku cadang tersebut.
Apa yang Dilakukan Transpareo Saat Ini
Sistem terjemahan kami secara otomatis menerjemahkan setiap konten baru ke dalam semua bahasa yang aktif. Sistem ini memiliki empat ciri khas:
-
Pelestarian Markdown dan Variabel: Tanda tempat seperti
<a href="/id/mendaftar">Pro-Mitgliedschaft</a>dan struktur Markdown diekstraksi sebelum penerjemahan, teks murni diterjemahkan, kemudian struktur tersebut dimasukkan kembali tanpa perubahan. Dengan demikian, tautan, formulir, dan tata letak tetap konsisten di seluruh bahasa. - Entri terjemahan terpusat: Terjemahan tidak disimpan dalam entri data itu sendiri, melainkan dalam lapisan bersama. Beberapa entri data dengan teks asli yang sama berbagi satu terjemahan. Hal ini menghemat biaya terjemahan dan secara otomatis menyatukan istilah-istilah di seluruh model data.
- Penerjemahan ulang otomatis saat terjadi perubahan: Jika teks asli diubah, terjemahan dalam semua bahasa akan dibuat ulang. Satu koreksi dalam bahasa Jerman akan secara otomatis diterapkan pada 39 versi bahasa lainnya.
- Penandaan per catatan data: Konten dapat dikecualikan dari proses otomatis atau terjemahan yang ada dapat dikunci - misalnya untuk nama produk internasional atau koreksi manual.
Di mana pelanggan melengkapi pemrosesan
Terjemahan otomatis sebagian besar memberikan hasil yang akurat untuk teks deskripsi, teks pemasaran, dan petunjuk perawatan. Namun, untuk terminologi teknis yang kritis - seperti “seal”/“guarnizione” - masih terdapat sejumlah kesalahan yang harus dikoreksi oleh admin pelanggan.
Di sini, admin memiliki tiga opsi:
- Penggantian manual per bahasa dan kata kunci: Setiap entri terjemahan dapat dibuka di Pengelola Aplikasi dan disesuaikan per bahasa. Dengan menandai “Lokasikan”, terjemahan manual ini akan tetap dipertahankan pada proses otomatis berikutnya.
- Impor glosarium: Terminologi yang sudah ada dari alat penerjemahan atau glosarium PDF dapat diimpor dalam format CSV dan langsung menghasilkan entri terjemahan.
- Koreksi per bahasa selama sistem berjalan: Tim penjualan Italia menemukan kesalahan, lalu mengoreksinya di Application Manager - koreksi tersebut langsung berlaku, sedangkan terjemahan lainnya tetap tidak berubah.
Manajer Aplikasi mendukung 40 bahasa yang sama
Tidak hanya lembar data produk yang multibahasa - antarmuka tempat Anda mengelolanya pun demikian. Manajer Aplikasi telah diterjemahkan ke dalam semua 40 bahasa, dan Anda dapat memasukkan konten dalam salah satu dari bahasa-bahasa tersebut. Sistem akan menerjemahkannya secara otomatis ke semua bahasa lainnya.
Bagi tim multibahasa, hal ini secara nyata mengubah cara kerja sama: Tim manajemen produk di Milan menulis petunjuk perawatan dalam bahasa Italia, tim pembelian di Warsawa melengkapi data bahan dalam bahasa Polandia, dan tim jaminan kualitas di Hamburg memeriksanya dalam bahasa Jerman. Setiap orang bekerja dalam bahasanya masing-masing, semua melihat kumpulan data yang sama - dan siapa pun yang mengoreksi suatu informasi, koreksinya berlaku untuk semua versi bahasa secara bersamaan.
Di sini pun berlaku batasan yang disebutkan di atas: Untuk terminologi teknis yang kritis, pada akhirnya harus ada manusia yang memeriksa pilihan yang dibuat oleh mesin.
Realitas Bahasa-Bahasa UE
24 bahasa resmi UE terdengar banyak. Dalam praktiknya, ada tiga tingkatan:
- Pasar inti: DE, EN, FR, IT, ES, NL - di sini setiap konsumen mengharapkan kesempurnaan
- Pasar penting: PT, PL, SV, DA, FI - kualitasnya baik, sesekali terlihat hasil terjemahan mesin
- Bahasa langka: MT, GA, ET, LV, LT - terkadang terdapat DPP dalam bahasa Malta, padahal tidak ada konsumen akhir di Malta yang akan membacanya. Namun, hal ini tetap wajib.
Kewajiban ini tidak bersifat opsional. ESPR mewajibkan konten DPP dalam bahasa negara anggota tempat produk tersebut dijual. Jadi, bagi yang melayani 27 negara, ada 24 bahasa yang terlibat (beberapa negara berbagi bahasa).
Dari bahasa Malta hingga bahasa Bengali
Transpareo menerjemahkan ke dalam 40 bahasa - seluruh 24 bahasa resmi UE dan 16 bahasa lainnya untuk jangkauan global:
- Eropa: Bulgaria, Denmark, Jerman, Inggris, Estonia, Finlandia, Prancis, Yunani, Irlandia, Italia, Kroasia, Latvia, Lituania, Bahasa Malta, Belanda, Polandia, Portugis, Rumania, Swedia, Slowakia, Slovenia, Spanyol, Ceko, dan Hongaria - ditambah Bahasa Albania, Bosnia, Islandia, Makedonia, Norwegia, Rusia, Serbia, Turki, dan Ukraina.
- Seluruh dunia: Bengali, Cina, Hindi, Indonesia, Jepang, Korea, dan Vietnam.
Untuk DPP tekstil yang akan datang, bahasa Bengali dan Vietnam telah mencakup negara-negara produsen utama - seorang pemasok di Dhaka membaca deskripsi yang sama seperti seorang pembeli di Paris.
Mengapa Lapisan Lokalisasi Terpusat
Sebagian besar platform menyimpan terjemahan sebagai kolom tambahan pada set data: description_de, description_en, … 40 kolom per atribut yang dapat diterjemahkan. Kedengarannya sederhana, tetapi memiliki tiga kelemahan:
- Teks yang disimpan dua kali. Dua produk dengan keterangan bahan yang sama menghasilkan 40 + 40 terjemahan, bukan hanya 40 terjemahan
- Sulit diskalakan. Menambahkan bahasa ke-41 berarti: migrasi skema di seluruh model yang dapat diterjemahkan
- Koreksi sulit diterapkan secara global. Jika “guarnizione” dikoreksi di mana-mana, semua catatan data harus diedit satu per satu
Lapisan terjemahan terpisah memecahkan masalah ini: satu entri, banyak referensi. Satu koreksi, semua catatan data mendapat manfaatnya.
Apa yang belum kami miliki
Basis data terminologi khusus klien dengan fitur saran otomatis sedang dalam perencanaan pengembangan, namun belum tersedia saat ini. Bagi yang memulai hari ini, alat yang ada sudah cukup memadai: penggantian manual, impor glosarium, dan penandaan “pertahankan” sudah mencakup kasus penggunaan yang paling umum.
Kami percaya bahwa mesin seharusnya menangani sebagian besar pekerjaan, dan manusia hanya perlu turun tangan jika benar-benar diperlukan. Sampai fitur pengenalan terminologi otomatis tersedia, opsi manual ini tetap transparan - dan itu lebih jujur daripada janji yang tidak ditepati.
Pertanyaan mengenai posting ini
Dalam bahasa apa saja sertifikat produk harus tersedia?
ESPR mewajibkan isi label disajikan dalam bahasa negara anggota tempat produk tersebut dijual. Bagi yang memasok ke seluruh Uni Eropa, hal ini berarti harus mempertimbangkan 24 bahasa resmi UE, di mana beberapa di antaranya digunakan bersama oleh beberapa negara. Transpareo menyediakan 24 bahasa tersebut serta 16 bahasa lainnya, dan setiap teks baru atau yang diubah akan secara otomatis diterjemahkan ke dalam semua bahasa tersebut. Secara praktis, hal ini berarti bahwa bahasa tidak lagi menjadi kriteria awal - Anda cukup menulis sekali dalam bahasa yang Anda gunakan untuk bekerja, dan versi untuk pasar lainnya akan mengikuti.
Siapa yang bertanggung jawab jika terjemahan mesin salah menerjemahkan istilah teknis?
Mereka. Kewajiban untuk memastikan keakuratan isi label produk berada pada pelaku usaha yang memasarkan produk tersebut, dan kewajiban ini tidak dialihkan baik kepada sistem terjemahan maupun kepada kami. Oleh karena itu, kami secara terbuka menjelaskan di mana mesin dapat membantu dan di mana tidak - deskripsi, petunjuk perawatan, dan teks pemasaran dihasilkan dengan rapi, sedangkan istilah teknis yang spesifik seperti nama komponen, pengunci, atau lapisan memerlukan sentuhan manusia. Anggaplah hasil terjemahan otomatis ini sebagai draf awal yang lengkap dalam 40 bahasa, dan alokasikan waktu pemeriksaan Anda untuk beberapa ratus istilah yang benar-benar penting bagi bengkel perbaikan dan pembeli.
Bagaimana cara mengoreksi suatu istilah agar tidak terhapus saat proses otomatis berikutnya dijalankan?
Buka entri terjemahan di Pengelola Aplikasi, sesuaikan nilai untuk bahasa yang bersangkutan, dan centang kotak “Simpan”. Penandaan ini akan mengecualikan entri tersebut dari proses otomatis, sehingga entri tersebut tetap utuh meskipun teks aslinya diubah di kemudian hari. Tanpa penandaan, koreksi Anda akan dianggap sebagai terjemahan biasa dan akan dihasilkan ulang begitu teks aslinya berubah. Untuk satu kata, langkah dua tahap yang sama berlaku seperti untuk satu paragraf penuh.
Apakah kita bisa mengimpor daftar terminologi yang sudah ada?
Ya. Terminologi yang memang sudah Anda kelola, baik dari alat penerjemahan maupun dari glosarium PDF agensi Anda, dapat diimpor dalam format CSV dan akan muncul sebagai entri terjemahan tertulis. Entri-entri ini kemudian akan diperlakukan seperti koreksi manual. Waktu yang paling tepat untuk melakukannya adalah sebelum impor besar-besaran pertama - sehingga istilah-istilah tersebut sudah tersedia sebelum ribuan catatan data diterjemahkan, dan tidak ada yang perlu diperbaiki kemudian.
Apakah koreksi ini berlaku untuk semua produk atau hanya untuk catatan data yang sedang dibuka?
Untuk setiap entri data dengan teks asli yang sama. Terjemahan disimpan dalam lapisan terpisah, bukan pada masing-masing produk; sehingga entri data yang identik berbagi satu entri, dan satu kali koreksi berlaku untuk semuanya. Oleh karena itu, beban koreksi tidak bertambah seiring bertambahnya katalog - satu istilah pada 4.000 produk hanya memerlukan satu entri, bukan 4.000.
Apakah rekan-rekan kerja di luar negeri harus bekerja dalam bahasa Jerman atau bahasa Inggris?
Tidak. Aplikasi Manajer itu sendiri tersedia dalam ke-40 bahasa tersebut, dan konten dapat dimasukkan dalam setiap bahasa tersebut. Tim manajemen produk di Milan menulis petunjuk perawatan dalam bahasa Italia, tim pembelian di Warsawa melengkapi data bahan dalam bahasa Polandia, dan semua pihak melihat set data yang sama. Siapa pun yang mengoreksi suatu informasi, koreksi tersebut berlaku untuk semua versi bahasa secara bersamaan, sehingga tidak perlu lagi melalui proses terjemahan melalui unit terjemahan pusat seperti biasanya.
Apakah ada fitur pengenalan terminologi otomatis?
Hari ini belum. Basis data terminologi khusus klien yang secara otomatis mengusulkan istilah-istilah sedang dalam tahap perencanaan pengembangan dan belum dirilis. Sampai saat itu, opsi yang tersedia adalah penggantian manual, penandaan “simpan”, dan impor glosarium. Kami lebih memilih untuk menjelaskan hal ini secara jelas daripada Anda merencanakan penggunaan fitur yang sebenarnya belum tersedia. Untuk kasus-kasus yang umum, ketiga alat tersebut sudah cukup untuk menangani kebutuhan Anda, dan jumlah istilah yang perlu Anda tandai jauh lebih sedikit daripada jumlah istilah yang perlu diterjemahkan.




