Tập đoàn công nghệ Tencent đưa “AI giáp cốt văn” vào tuyển tập ứng dụng Innovate for Impact 2026, vừa được công bố tại hội nghị AI for Good ở Geneva, Thụy Sĩ. Đây là 1 trong 59 trường hợp được chứng nhận, được chọn từ hơn 400 hồ sơ của 40 quốc gia và là đại diện duy nhất thuộc lĩnh vực chữ viết cổ.

Vì sao chữ giáp cốt cần AI?

Giáp cốt văn (oracle bone script) là hệ thống chữ viết sớm nhất được phát hiện ở Trung Quốc, được người Ân Thương khắc lên mai rùa và xương thú cách đây hơn 3.000 năm. Di chỉ Yinxu (Ân Khư) tại thành phố Anyang, tỉnh Hà Nam (Henan), là nơi phát hiện nhiều giáp cốt văn quan trọng nhất. Giới nghiên cứu đã thống kê hơn 4.500 chữ đơn, nhưng hơn 2/3 số chữ này chưa được khảo thích, tức chưa giải mã được nghĩa.

Liu Yongge, giám đốc Phòng thí nghiệm trọng điểm xử lý thông tin giáp cốt văn của Bộ Giáo dục Trung Quốc đặt tại Đại học Sư phạm Anyang, cho biết trước đây một học giả có thể mất nhiều năm chỉ để làm rõ nghĩa một chữ. Các mảnh giáp cốt bị phân tán ở nhiều nơi trên thế giới, khiến việc so sánh và ghép nối bằng mắt thường rất chậm.

Vấn đề cấp bách hơn nằm ở chất liệu: xương và mai rùa vẫn đang phong hóa từng ngày. Theo Liu Yongge, số hóa là việc không thể trì hoãn, và đó là lý do nhóm chọn con đường “AI + giáp cốt văn”.

Ba năm đưa “AI giáp cốt văn” từ mô phỏng tới công cụ khép kín

Cuối năm 2022, thành phố Anyang phối hợp cùng phòng thí nghiệm văn hóa số Tencent SSV (Tencent SSV Digital Culture Laboratory) và phòng thí nghiệm YouTu của Tencent (Tencent YouTu Laboratory) khởi động nền tảng mở về đổi mới sáng tạo giáp cốt văn. Mục tiêu là dùng công nghệ số hỗ trợ nghiên cứu và truyền bá di sản, đi qua ba cột mốc chính.

NămTrọng tâmKết quả chính
2023Số hóa nền tảng, giúp công chúng nhìn thấy chữ cổRa mắt mô hình dữ liệu toàn thông tin và ứng dụng nhỏ “Amazing Oracle Bone Inscriptions”, dùng kể chuyện, trò chơi và sáng tạo chữ để phổ cập giáp cốt văn
2024Làm sâu dữ liệuCông bố chương trình “Digital Oracle Bone Co-creation”, thành lập trung tâm đồng sáng tạo, đưa lên nền tảng AI “Yinqi Wenyuan”; kỹ thuật tăng cường dấu vết vi mô và thuật toán khớp hình chữ giúp phục dựng mảnh vỡ và tìm kiếm thông minh
2025Ứng dụng thực tếRa mắt “Yinqi Xingzhi”, trợ lý AI giáp cốt văn đầu tiên trên thế giới, do phòng thí nghiệm phối hợp Tencent và Đại học Hạ Môn (Xiamen University) phát triển; tải ảnh lên là AI nhận diện chữ, giải nghĩa, truy nguồn và tạo bản mô phỏng số

Phía sau giao diện đơn giản là hai chiều phục vụ: chuyên gia ngôn ngữ cổ dùng công cụ so sánh, tra cứu để tăng tốc ghép nối và khảo thích; công chúng dùng ứng dụng trên điện thoại để tự trải nghiệm đọc chữ cổ tại nhà. Liu Yongge nhấn mạnh dự án không đơn thuần chồng công nghệ lên dữ liệu, mà để AI thực sự hiểu chữ cổ và đưa nghiên cứu từ kinh nghiệm sang vận hành theo dữ liệu.

Mô hình năm lực lượng giúp AI không đọc sai chữ cổ

Dự án không do một công ty hay một trường đại học ôm trọn, mà tập hợp năm đơn vị, mỗi bên đảm nhận một mắt xích. Tencent SSV Digital Culture Laboratory là đơn vị khởi xướng, lo kết nối nguồn lực, tổ chức truyền thông và các cuộc thi số hóa; Tencent YouTu Laboratory chịu trách nhiệm nghiên cứu thuật toán, hoàn thành hơn 10 thuật toán cốt lõi và thiết kế kiến trúc trợ lý AI.

Đại học Sư phạm Anyang đóng vai “từ điển sống” của máy: giảng viên và sinh viên rà soát hàng chục triệu dữ liệu văn bản giáp cốt, đối chiếu bản khắc, chú giải và đặc trưng chữ để hạn chế AI hiểu sai nghĩa. Đại học Hạ Môn (Xiamen University) tham gia lặp thuật toán cốt lõi, xây dựng bộ dữ liệu đa phương thức gồm ảnh, văn bản và đặc trưng chữ. Tencent Cloud Intelligence đảm nhiệm hạ tầng hệ thống, giữ cho trợ lý AI vận hành ổn định.

Sự phối hợp này tạo thành chuỗi “di sản – nghiên cứu – phát triển AI – truyền thông đại chúng” hoàn chỉnh. Giới chuyên môn nhìn nhận đây là mô hình tham khảo để nhiều di sản văn hóa khác của Trung Quốc có thể số hóa và lan tỏa trong thời đại số.

Hướng đi tiếp theo và bài học với độc giả Việt Nam

Liu Yongge tiết lộ phòng thí nghiệm sẽ mở rộng bộ dữ liệu đa phương thức, tiếp tục nâng cấp mô hình AI quy mô lớn (large model) dành riêng cho giáp cốt văn và triển khai “kế hoạch hồi hương số giáp cốt toàn cầu”. Nhóm sẽ thu thập thêm ảnh số độ nét cao từ các bảo tàng nước ngoài để những mảnh giáp cốt đang nằm rải rác có thể “trở về” dưới dạng dữ liệu số.

Đại diện Tencent SSV Digital Culture Laboratory cho biết sẽ tiếp tục tối ưu công cụ nhận diện, hoàn thiện kho tài nguyên số và mở rộng kênh truyền bá trực tuyến, dựa trên triết lý AI vì lợi ích cộng đồng. Hội nghị AI for Good, khởi động từ 2017 và do Liên minh Viễn thông Quốc tế (ITU) cùng hàng chục đối tác Liên Hợp Quốc tổ chức, cũng là nơi nhóm giới thiệu giải pháp này cho việc bảo tồn chữ hình nêm, chữ Maya và các hệ chữ cổ khác.

Với độc giả Việt Nam, câu chuyện này cho thấy AI có thể làm nhiều hơn việc tạo văn bản hay hình ảnh mới: nó còn giúp nhận diện, tra cứu và bảo tồn các bộ chữ cổ đang có nguy cơ mai một. Mô hình phối hợp giữa doanh nghiệp công nghệ, trường đại học và đơn vị nghiên cứu văn hóa là điều các nước, trong đó có Việt Nam, có thể tham khảo khi muốn số hóa di sản chữ viết của mình.

Ảnh: Pavel Danilyuk / Pexels