Tổng quan nghiên cứu

Bộ sách Tự Đức Thánh chế Tự học giải nghĩa ca do vua Tự Đức biên soạn vào nửa cuối thế kỷ XIX và được Quốc Sử quán triều Nguyễn khắc in vào năm 1898 là công trình tự điển song ngữ Hán - Nôm có quy mô lớn nhất trong lịch sử văn tự học Việt Nam. Với tổng dung lượng 9.032 mục chữ Hán được giải nghĩa thông qua 4.572 câu thơ lục bát, tác phẩm ghi nhận tới 32.005 lượt xuất hiện của cả hai hệ văn tự.

Nghiên cứu tập trung giải quyết vấn đề cấu trúc và chức năng của chữ Nôm trong giai đoạn thoái trào nhưng đạt độ hoàn thiện cao nhất về mặt văn tự học. Mục tiêu trọng tâm của luận văn là giải mã toàn diện diện mạo chữ Nôm thời Nguyễn, phân tích cơ chế cấu tạo tự dạng, khảo sát cách thức giải nghĩa chữ Hán bằng chữ Nôm và đánh giá mức độ điển chế của văn tự dân tộc.

Phạm vi nghiên cứu bao quát toàn bộ 13 quyển của tác phẩm dựa trên bản khắc in nguyên gốc mang ký hiệu VHv.626 lưu trữ tại Viện Nghiên cứu Hán Nôm. Ý nghĩa khoa học của đề tài được khẳng định qua việc cung cấp hệ thống dữ liệu định lượng với độ tương đồng học thuật đạt từ 88% đến 89,7% khi đối chiếu với chuẩn mực của Khang Hi tự điển, đồng thời bổ sung hàng trăm tự dạng mới vào kho ngữ liệu chữ Nôm truyền thống phục vụ công tác nghiên cứu và giảng dạy ngôn ngữ cổ.

Cơ sở lý thuyết và phương pháp nghiên cứu

Khung lý thuyết áp dụng

Nghiên cứu vận dụng hệ thống lý thuyết văn tự học phương Đông kết hợp với phương pháp phân tích cấu trúc ngôn ngữ học hiện đại. Cơ sở lý thuyết cốt lõi được xây dựng từ:

  1. Thuyết "Lục thư" cổ điển trong Thuyết văn giải tự của Hứa Thận: Luận văn tập trung khai thác 3 phương thức tạo chữ phù hợp với bản chất chữ Nôm gồm giả tá (mượn âm), hình thanh (ghép âm và nghĩa) và hội ý (ghép nghĩa).
  2. Mô hình phân loại cấu trúc chữ Nôm của Giáo sư Nguyễn Tài Cẩn và học giả N. Stankevich: Khung phân tích thực hiện các bước lưỡng phân cấu trúc nội tại để chia hệ thống chữ Nôm thành 2 khối lớn (chữ mượn Hán và chữ tự tạo), phân rã chi tiết thành 10 kiểu loại cấu tạo từ A1, A2 đến G1, G2.
  3. Các khái niệm then chốt: Chữ Nôm chính âm Hán Việt, chữ Nôm Hán Việt hóa, chữ Nôm ghi âm cổ, chữ ghép ý - âm, và tính điển chế văn tự thời Nguyễn.

Phương pháp nghiên cứu

Nguồn dữ liệu của luận văn được xử lý trực tiếp từ bản in mộc bản VHv.626 gồm 4 cuốn, 295 tờ (tương đương gần 600 trang in chuẩn). Phương pháp chọn mẫu phân tích sâu được tiến hành trên 2 mẫu đại diện tiêu biểu: 100 chữ Hán đầu tiên của Nhân sự loại (thượng) và 100 chữ Hán đầu tiên của Chính hóa loại (thượng). Lý do lựa chọn 2 mẫu này vì đây là những nhóm từ vựng căn bản phản ánh trực tiếp đời sống con người và hệ tư tưởng giáo hóa xã hội triều Nguyễn.

Phương pháp nghiên cứu kết hợp giữa thống kê định lượng và ngữ văn học lịch sử:

  • Thống kê tần số xuất hiện của từng kiểu cấu tạo chữ Nôm và phân loại toàn bộ 9.032 mục từ.
  • So sánh đối chiếu liên văn bản giữa Tự Đức Thánh chế Tự học giải nghĩa ca với 6 bộ tự điển Hán - Nôm tiêu biểu khác như Đại Nam quốc ngữ, Chỉ nam ngọc âm giải nghĩa, Nam phương danh vật bị khảo, Tam thiên tự giải âm, Nhật dụng thường đàm và Nan tự giải âm.
  • Thời gian thu thập, xử lý ngữ liệu và hoàn thiện hệ thống phân loại diễn ra liên tục từ năm 2002 đến năm 2005.

Kết quả nghiên cứu và thảo luận

Những phát hiện chính

Nghiên cứu đưa ra 4 phát hiện quan trọng về mặt định lượng và cấu trúc văn bản:

Thứ nhất, quy mô từ vựng của tác phẩm vượt trội hoàn toàn so với các bộ tự điển cùng thời. Với 9.032 mục chữ Hán được giải nghĩa, tác phẩm có dung lượng lớn hơn 89% so với Đại Nam quốc ngữ (4.779 chữ), gấp 2,66 lần so với Chỉ nam ngọc âm giải nghĩa (3.394 chữ), và gấp hơn 3 lần so với Tam thiên tự giải âm (2.988 chữ).

Thứ hai, cấu trúc phân bố môn loại thể hiện tính hệ thống cao với 7 môn loại cụ thể:

  • Nhân sự loại: 2.162 mục chữ (chiếm 23,94%).
  • Chính hóa loại: 1.587 mục chữ (chiếm 17,57%).
  • Khí dụng loại: 1.474 mục chữ (chiếm 16,32%).
  • Kham dư loại: 1.379 mục chữ (chiếm 15,27%).
  • Thảo mộc loại: 1.114 mục chữ (chiếm 12,33%).
  • Cầm thú loại: 770 mục chữ (chiếm 8,53%).
  • Trùng ngư loại: 546 mục chữ (chiếm 6,04%).

Thứ ba, mức độ chuẩn hóa và bám sát chính tự rất cao. Khi so chiếu 100 chữ đầu tiên của Nhân sự loại, có 78 chữ xuất hiện trong Khang Hi tự điển với 69 chữ đồng nhất về ngữ nghĩa (đạt tỷ lệ tương đồng 88%), 22 chữ còn lại (chiếm 22%) là các từ chỉ cơ thể người mang tính thực dụng bản địa. Ở Chính hóa loại, tỷ lệ đồng nhất ngữ nghĩa đạt tới 89,7% (88/98 chữ đối chiếu), cho thấy sự chuẩn mực tuyệt đối trong thuật ngữ chính trị - đạo đức.

Thứ tư, phương thức giải nghĩa linh hoạt qua cấu trúc "A là B". Ngoài hình thức đối dịch 1-1 theo vần lục bát, tác phẩm đã sử dụng tới 926 lần từ "là" để diễn giải chi tiết các khái niệm phức tạp, điển hình ở môn Cầm thú loại (139 chữ) và Thảo mộc loại (thượng) (116 chữ).

Thảo luận kết quả

Dữ liệu phân tích cấu trúc chữ Nôm có thể được mô hình hóa qua bảng tỷ lệ phân bố môn loại và biểu đồ tương quan ngữ nghĩa với Khang Hi tự điển. Kết quả cho thấy vua Tự Đức và các học giả Quốc Sử quán đã xây dựng một công trình có tính chất bách khoa thư sơ khai, vừa đảm bảo tính quy chuẩn khoa cử triều Nguyễn, vừa gắn liền với tiếng Việt thực tiễn.

Nguyên nhân của tỷ lệ đồng nhất 88% - 89,7% bắt nguồn từ việc triều đình nhà Nguyễn lấy Khang Hi tự điển làm quy chuẩn thi cử và hành chính. Điểm sáng tạo lớn nhất của tác phẩm là việc dung nạp 22% các chữ chỉ bộ phận cơ thể và hoạt động dân dã không có trong từ điển Trung Quốc, bảo tồn nhiều yếu tố phương ngữ Huế và âm vị học tiếng Việt nửa cuối thế kỷ XIX. Điều này chứng minh chữ Nôm giai đoạn này không chỉ là công cụ giải nghĩa mà đã đạt tới trình độ văn tự độc lập, giàu năng lực biểu đạt.

Đề xuất và khuyến nghị

Dựa trên kết quả khảo sát toàn diện từ bản văn VHv.626, nghiên cứu đề xuất 4 nhóm giải pháp cụ thể:

  1. Số hóa toàn bộ 9.032 mục từ Hán - Nôm và tích hợp hệ thống 10 kiểu cấu tạo chữ Nôm vào Cơ sở dữ liệu Quốc gia về Văn tự cổ. Đơn vị thực hiện là Viện Nghiên cứu Hán Nôm phối hợp cùng các trung tâm công nghệ ngôn ngữ, đặt mục tiêu hoàn thành trong vòng 24 tháng.
  2. Chuẩn hóa mã Unicode quốc tế cho 22% các tự dạng chữ Nôm hiếm và chữ Nôm phương ngữ chưa được đăng ký mã chuẩn. Mục tiêu nâng tỷ lệ phủ mã Unicode của kho chữ thời Nguyễn lên 95% trước năm 2028, do Hội Di sản Hán Nôm và các chuyên gia văn tự học chủ trì.
  3. Đưa tư liệu Tự Đức Thánh chế Tự học giải nghĩa ca vào chương trình đào tạo sau đại học ngành Hán Nôm, Ngôn ngữ học và Ngữ văn tại Đại học Quốc gia Hà Nội. Mục tiêu tăng 35% thời lượng thực hành giải mã cấu trúc chữ Nôm cho học viên cao học bắt đầu từ năm học 2026 - 2027.
  4. Biên soạn và tái bản ấn bản hiệu đính toàn diện 13 quyển kèm hệ thống tra cứu đối chiếu Khang Hi, do Nhà xuất bản Đại học Quốc gia phối hợp với nhóm nghiên cứu thực hiện trong lộ trình 3 năm.

Đối tượng nên tham khảo luận văn

  1. Nhà nghiên cứu Hán Nôm và Văn tự học: Khai thác kho ngữ liệu 9.032 mục từ và 163 trang phụ lục phân loại cấu trúc để đối chiếu văn bản học, xác định niên đại và phong cách tạo chữ thời Nguyễn.
  2. Giảng viên và học viên cao học ngành Ngôn ngữ học: Sử dụng dữ liệu về 10 mô hình cấu tạo chữ Nôm, sự chuyển hóa ngữ âm và các nét đặc thù của phương ngữ Huế thế kỷ XIX làm tài liệu giảng dạy và đề tài chuyên sâu.
  3. Kỹ sư Công nghệ ngôn ngữ (NLP) và Xử lý di sản số: Tận dụng tập dữ liệu 32.005 lượt xuất hiện song ngữ đã phiên âm chuẩn xác làm dữ liệu huấn luyện cho các mô hình nhận dạng chữ Nôm (OCR) và mô hình dịch máy tự động Hán - Nôm sang Quốc ngữ.
  4. Nhà nghiên cứu Lịch sử văn hóa và Giáo dục truyền thống: Tiếp cận phương pháp phân chia 7 môn loại tri thức thời Tự Đức để đánh giá tư duy giáo dục, sự tiếp biến văn hóa và vai trò của song ngữ Hán - Nôm trong nền khoa cử phong kiến.

Câu hỏi thường gặp

1. Tự Đức Thánh chế Tự học giải nghĩa ca có vị thế như thế nào so với các tự điển Hán - Nôm khác?

Tác phẩm là cuốn tự điển song ngữ Hán - Nôm có quy mô đồ sộ nhất lịch sử Việt Nam với 9.032 mục chữ Hán được giải nghĩa qua 4.572 câu thơ lục bát, vượt xa công trình đứng thứ hai là Đại Nam quốc ngữ với 4.779 chữ và Chỉ nam ngọc âm giải nghĩa với 3.394 chữ.

2. Vì sao có tới 22% chữ trong môn Nhân sự không có trong Khang Hi tự điển?

Khoảng 22% chữ Hán trong môn Nhân sự (như các từ chỉ răng hô, mắt lòa, chùm ruột non) là những từ ngữ thực dụng chỉ cơ thể người và đời sống hàng ngày của người Việt. Tác giả đã tự tạo hoặc sử dụng biến thể chữ Hán để phục vụ việc giải nghĩa sát với tiếng Việt thực tiễn.

3. Tác phẩm giải quyết vấn đề gieo vần lục bát khắt khe như thế nào khi giải nghĩa từ vựng?

Tác giả đã kết hợp linh hoạt lối đối dịch trực tiếp 1-1 với lối giải thích qua mô thức "A là B", đồng thời sử dụng 926 chữ "là" cùng các từ đệm và từ láy để đảm bảo cấu trúc vần lục bát mà không làm sai lệch ngữ nghĩa gốc của chữ Hán.

4. Luận văn sử dụng mô hình lý thuyết nào để phân tích cấu trúc chữ Nôm?

Luận văn áp dụng mô hình phân loại của Giáo sư Nguyễn Tài Cẩn và N. Stankevich, thực hiện quy trình lưỡng phân cấu trúc nội tại để chia chữ Nôm thành 2 nhánh lớn (mượn Hán và tự tạo) với 10 kiểu cấu tạo chi tiết từ A1 đến G2.

5. Tác phẩm phản ánh những nét đặc trưng gì của tiếng Việt thế kỷ XIX?

Tác phẩm ghi lại chân thực diện mạo tiếng Việt giai đoạn cận đại với hệ thống ngữ âm ổn định, cấu trúc từ vựng phong phú và dấu ấn đậm nét của phương ngữ miền Trung (Huế) trong cách sử dụng từ ngữ và gieo vần.

Kết luận

  • Luận văn đã nghiên cứu toàn diện bộ tự điển Hán - Nôm lớn nhất Việt Nam với quy mô 9.032 mục chữ Hán, 4.572 câu lục bát và 32.005 lượt tự dạng.
  • Xác lập cơ sở định lượng vững chắc cho 10 kiểu cấu tạo chữ Nôm theo mô hình phân loại văn tự học hiện đại.
  • Chứng minh độ tương đồng ngữ nghĩa cao từ 88% đến 89,7% so với chuẩn Khang Hi tự điển, khẳng định tính chuẩn mực của văn tự triều Nguyễn.
  • Làm rõ dấu ấn phương ngữ Huế và bức tranh tiếng Việt thế kỷ XIX được lưu giữ qua 7 môn loại bách khoa thư.
  • Đóng góp 163 trang phụ lục chi tiết làm nguồn ngữ liệu chuẩn hóa phục vụ các dự án từ điển điện tử và công nghệ số hóa di sản.

Công trình tạo tiền đề vững chắc cho các nghiên cứu liên ngành giữa văn tự học cổ điển và công nghệ xử lý ngôn ngữ tự nhiên. Độc giả và giới nghiên cứu có thể khai thác trực tiếp nguồn ngữ liệu này để tiếp tục phát triển các đề tài số hóa di sản Hán Nôm trong giai đoạn 2026 - 2030.