Khi chuyển đổi JSON-LD chuẩn mực và phù hợp với ngữ cảnh sang định dạng tuần tự hóa mở rộng của EN 18223, điều đầu tiên gây chú ý chính là quy mô của nó. Hình thức này rõ ràng rất rườm rà.
EN 18223 là tiêu chuẩn của CEN/CLC JTC 24 về khả năng tương tác hệ thống của Hộ chiếu Sản phẩm Kỹ thuật số; Điều khoản 4 của tiêu chuẩn này định nghĩa mô hình ngữ nghĩa, còn Điều khoản 5.2 định nghĩa định dạng tuần tự hóa. Định dạng tuần tự hóa này có hai dạng. Hình thức tuần tự hóa nén được sử dụng trong thực tế lấy elementId của mỗi giá trị làm khóa đối tượng và để dictionaryReference cùng valueDataType được giải quyết thông qua từ điển dữ liệu. Dạng mở rộng ghi ra tất cả: Mỗi giá trị trở thành một đối tượng có elementId, dictionaryReference, objectType, valueDataType và value riêng, và ba dòng dữ liệu nguồn trở thành hai mươi dòng.
Lợi ích đằng sau sự dài dòng
Sự dài dòng nàykhông phải ngẫu nhiên, và việc hiểu rõ lợi ích ## mànó## manglại là điều đáng giá.
Đó chính là điều mà ngữ nghĩa trở thành khi người ta không thể giả định rằng nó có thể được giải mã công khai trực tuyến nữa. Một tài liệu JSON-LD thường truyền tải ý nghĩa thông qua một @context: một liên kết mà người đọc theo dõi để tra cứu ý nghĩa của một trường.
Dạng nén chỉ hoạt động khi người đọc có thể tra cứu từ điển đằng sau một trường. Điều này sẽ thất bại nếu từ điển đó là ECLASS hoặc IEC CDD - cả hai đều phải trả phí, không thể tra cứu miễn phí như một IRI @context mở. Đây chính là lý do tại sao dạng mở rộng lại có độ dài như vậy: nó ghi rõ ý nghĩa từng giá trị một - từ điển nào, mục từ nào, loại nào, giá trị nào - và vẫn tự giải thích được ngay cả khi không thể tin tưởng rằng người đọc sẽ nhấp vào để tra cứu.
Khi đọc như vậy, sự dài dòng không phải là lỗi thiết kế, mà là một phản ứng hợp lý đối với các từ điển đóng.
Sự tương phản là rõ ràng. Các từ vựng mà chúng ta dựa vào - OpenEPCIS DPP Core và các phần mở rộng theo quy định của nó - được công bố công khai tại ref.openepcis.io và vẫn có thể giải mã tự do. Chỉ một tham chiếu @context duy nhất đã mang ý nghĩa mà một từ điển đóng buộc phải ghi vào.
Tại sao hướng đi lại quan trọng
Tái tạo ngữ nghĩa mở từ một từ điển đóng là hướng đi khó khăn. Ngược lại thì lại đơn giản.
Nguồn JSON-LD của chúng tôi đã chứa sẵn mọi thuộc tính mà mô hình EN 18223 yêu cầu: một tham chiếu đến thuộc tính, một tham chiếu đến từ điển, một kiểu dữ liệu giá trị, một mảng ngôn ngữ cho mỗi giá trị. Chúng chỉ được biểu diễn dưới dạng các đối tượng JSON-LD được định kiểu với các IRI @context, thay vì trong cấu trúc phẳng “Thực thể-Thuộc tính-Giá trị” của EN 18223.
Việc tạo ra một bản xem theo tiêu chuẩn EN 18223 từ dữ liệu này chỉ là một tác vụ định dạng: lấy các trường đã có sẵn và chuyển chúng sang định dạng mục tiêu.
Nguyên tắc này có thể tóm gọn trong một câu: Một nguồn dữ liệu có không gian tên mở sẽ tạo ra một phép chiếu từ mỗi từ điển đóng, do đó sự rườm rà trở thành một cái giá mà chỉ những ai bắt đầu với cấu trúc đóng mới phải trả. Nếu ý nghĩa đã được công khai ngay từ khi viết lần đầu, cái giá này sẽ tự động biến mất.
Các không gian tên số nhiều thay vì một từ vựng chuẩn
Việc nguồn dữ liệu của chúng tôi đã có dạng này là một quyết định có chủ ý, không phải ngẫu nhiên. Chúng tôi không ép buộc mọi quy định phải tuân theo một từ vựng duy nhất.
Mỗi quy định DPP của EU - về pin, dệt may, điện tử và những quy định sắp tới - đều giữ không gian tên riêng ở cấp trên: của GS1, của OpenEPCIS DPP Core, và của phần mở rộng quy định tương ứng. Tất cả đều tồn tại song song trong một mảng @context, bên cạnh một không gian tên transpareo: được thiết kế tối giản dành cho một số ít thuật ngữ không thuộc bất kỳ không gian tên nào ở cấp trên.
Tiêu chuẩn EN 18223 trong điều khoản mở đầu 0.3 của chính nó cũng yêu cầu gần như chính xác điều này: tránh các ontology dành riêng cho từng ngành, cho phép sử dụng song song các ontology được ban hành theo từng văn bản pháp lý được ủy quyền, và giữ cho lớp ngang càng chung chung càng tốt.
Một kiến trúc dựa trên các không gian tên mở và song song không chỉ phù hợp với mục đích của tiêu chuẩn. Đó chính là điều mà nguyên tắc thiết kế của chính tiêu chuẩn này hướng tới.
Một bài kiểm tra khả năng chịu tải: danh sách thuộc tính của Battery Pass
Bằng chứng nằm ở cách kiến trúc này tiếp nhận một từ điển mà nó vốn không được thiết kế để xử lý.
Danh sách dài các thuộc tính dữ liệu (Data Attribute Long List) của Battery Pass Consortium, phiên bản 1.3, là một từ điển thứ ba, khác biệt độc lập với cả EN 18223 lẫn GS1: khoảng 100 thuộc tính, cách đặt tên riêng, các cấp độ truy cập riêng, cùng cách hiểu của Hiệp hội về Phụ lục XIII của Quy định về Pin.
Chúng tôi đã đối chiếu danh sách này với mô hình dữ liệu hiện có của mình. 91 trong số 100 thuộc tính đã được ánh xạ nguyên vẹn vào các loại thuộc tính đã có sẵn. Một nguồn dựa trên nhiều không gian tên xem từ điển khép kín mới này như một phép chiếu bổ sung - nó không bắt buộc phải tái cấu trúc hệ thống.
Tình hình hiện tại của tiêu chuẩn
EN 18223 và tiêu chuẩn liên quan EN 18216 - tiêu chuẩn này định nghĩa định dạng tuần tự hóa cụ thể mà EN 18223 tham chiếu đến - đều là các tiêu chuẩn châu Âu được hài hòa.
Chúng thuộc đợt công bố đầu tiên của bộ tiêu chuẩn CEN-CENELEC-JTC-24-DPP: sáu trong số tám tiêu chuẩn, hai tiêu chuẩn còn lại - về xác thực và quyền truy cập - sẽ được công bố vào mùa hè năm 2026. Sáu tiêu chuẩn này đã được trích dẫn trong Quyết định thi hành (EU) 2026/1736 trên Công báo Liên minh Châu Âu, qua đó trao cho chúng tư cách tiêu chuẩn hài hòa và do đó được coi là tuân thủ các Điều 10 và 11 của Quy định Bảo vệ Dữ liệu Chung (ESPR).
Mặt tích cực
Không có điều nào trong số đó khiến EN 18223 trở thành tiêu chuẩn sai. Sự rườm rà chính là cái giá phải trả cho khả năng tương tác trong một thế giới mà không phải từ điển nào cũng mở, và tiêu chuẩn này phản ánh đúng thực tế đó.
Mặt tích cực rất đơn giản: Đối với những ai đã sử dụng JSON-LD chuẩn, EN 18223 chỉ là một sự mở rộng, không phải xây dựng từ đầu. Con đường tốn kém hơn lại là con đường kia - con đường mà bất kỳ ai bắt đầu từ một từ điển đóng đều phải đi.
Đối với những ai xây dựng trên nền tảng ngữ nghĩa mở và có thể phân tích ngay từ dòng đầu tiên, sự rườm rà của tiêu chuẩn sẽ không còn là gánh nặng nữa. Nó sẽ trở thành một định dạng đầu ra mà người ta có thể tạo ra khi cần thiết.
