Đinh Điền, ddien@fit.hcmus.edu.vn

KHOA CÔNG NGHỆ THÔNG TIN CHÚC MỪNG NHÓM NGHIÊN CỨU CỦA PGS.TS. ĐINH ĐIỀN VỚI KẾT QUẢ NGHIỆM THU NHIỆM VỤ KHOA HỌC VÀ CÔNG NGHỆ VỀ DỊCH TỰ ĐỘNG HÁN NÔM

Khoa Công nghệ thông tin trân trọng chúc mừng nhóm nghiên cứu do PGS.TS. Đinh Điền làm chủ nhiệm đã hoàn thành nhiệm vụ khoa học và công nghệ “Nghiên cứu xây dựng hệ thống dịch tự động Hán Nôm sang chữ Quốc ngữ giai đoạn 2”, do Trường Đại học Khoa học tự nhiên chủ trì thực hiện.

Nhiệm vụ vừa được Sở Khoa học và Công nghệ TP.HCM tổ chức Hội đồng tư vấn nghiệm thu, ghi nhận những kết quả quan trọng trong việc ứng dụng trí tuệ nhân tạo, xử lý ngôn ngữ tự nhiên và công nghệ ngôn ngữ vào bảo tồn, khai thác và phổ biến kho tàng di sản Hán Nôm của Việt Nam trong kỷ nguyên số.

Từ thực tiễn hàng triệu trang tư liệu Hán Nôm vẫn chưa được khai thác rộng rãi, nhóm nghiên cứu đã xây dựng hệ thống hỗ trợ nhận dạng, chuyển tự và dịch tự động hai chiều giữa Hán Nôm và chữ Quốc ngữ. Công trình góp phần tạo nền tảng công nghệ phục vụ nghiên cứu, giáo dục và bảo tồn di sản văn hóa dân tộc.

Kết quả này không chỉ thể hiện năng lực nghiên cứu chuyên sâu của nhóm trong lĩnh vực trí tuệ nhân tạo và xử lý ngôn ngữ tự nhiên, mà còn khẳng định vai trò của công nghệ thông tin trong việc giải quyết những bài toán mang giá trị xã hội, văn hóa và lịch sử.

Khoa Công nghệ thông tin trân trọng chúc mừng PGS.TS. Đinh Điền cùng nhóm nghiên cứu. Thành quả này là minh chứng cho tinh thần nghiên cứu bền bỉ, trách nhiệm và khát vọng đưa công nghệ hiện đại phục vụ bảo tồn di sản Việt Nam.

FIT-HCMUS tự hào đồng hành cùng những công trình nghiên cứu mang giá trị học thuật, công nghệ và nhân văn sâu sắc.

Nguồn tin, ảnh: Khoa học và Công nghệ Thành phố Hồ Chí Minh
https://www.facebook.com/share/p/1EEiELyGJD/?mibextid=wwXIfr

Chữ Nôm được người Việt sáng tạo dựa trên nền tảng chữ Hán vào khoảng thế kỷ thứ X và được sử dụng cho đến thế kỷ XIX. Trải qua gần một thiên niên kỷ, vô số các tác phẩm thuộc các lĩnh vực lịch sử, văn học, y học, nông nghiệp, địa lý và nhiều lĩnh vực khác đã được biên soạn bằng chữ Hán – Nôm. Tuy nhiên, phần lớn các kho tàng tài liệu này hiện vẫn chưa được "dịch" sang chữ Việt hiện đại (chữ Quốc ngữ). Thậm chí, ngay cả những hệ thống trí tuệ nhân tạo (AI) tiên tiến nhất trên thế giới hiện nay vẫn chưa có khả năng dịch được chữ Nôm.

Xuất phát từ thực tế đó, trung tâm của chúng tôi tập trung nghiên cứu và phát triển một hệ thống tự động để "dịch" các tài liệu Hán – Nôm sang chữ Quốc ngữ. Hệ thống "dịch" này bao hàm nhiều tác vụ thành phần, bao gồm phân loại ảnh, nhận dạng ảnh (OCR - Nhận dạng ký tự quang học), phân loại văn bản, chuyển tự (hay còn gọi là phiên âm sang âm Hán - Việt) và dịch nghĩa (diễn giải) sang ngôn ngữ đương đại.

Hệ thống này cho phép người dùng đọc, hiểu và khám phá kho tàng tri thức vô giá được viết bằng chữ Hán – Nôm do ông cha ta truyền lại, giờ đây có thể dễ dàng tiếp cận thông qua chữ Quốc ngữ hiện đại. Hệ thống hiện đang được triển khai trực tuyến tại các địa chỉ: https://kimhannom.clc.hcmus.edu.vn/ hoặc https://kimhannom.fit.hcmus.edu.vn/ cũng như trên ứng dụng di động KimHanNom.

Sản phẩm này được thực hiện bởi Trung tâm Ngôn ngữ học Tính toán, Khoa CNTT, Trường ĐH Khoa học Tự nhiên – ĐHQG – HCM.
(Nguồn: https://tools.clc.hcmus.edu.vn/)