Anthropic - công ty phát triển trợ lý AI Claude - đã chính thức bật mặc định tính năng gắn nhãn nhận diện nội dung AI trên toàn bộ dòng sản phẩm Claude kể từ ngày 2/8/2026. Theo thông báo ngày 11/8, văn bản do Claude tạo ra sẽ được nhúng watermark vô hình (hình mờ không thể nhìn bằng mắt thường), còn các file ảnh như .png, .jpg, .svg sẽ được gắn metadata nguồn gốc có chữ ký số theo chuẩn C2PA. Tính năng này áp dụng cho mọi người dùng Claude trên toàn cầu, không chỉ riêng thị trường châu Âu.
Cơ chế Claude nhận diện nội dung AI hoạt động ra sao?
Với văn bản, Anthropic sử dụng watermark nhúng ở tầng mô hình. Khi Claude sinh nội dung, một dấu hiệu vô hình được cài trực tiếp vào chuỗi văn bản. Loại dấu này không làm thay đổi ý nghĩa, chất lượng hay khả năng đọc, nhưng bám theo văn bản khi người dùng sao chép và có thể vẫn còn sau khi chỉnh sửa một phần. Vì được nhúng ngay trong mô hình ngôn ngữ lớn (LLM - loại AI chịu trách nhiệm sinh văn bản), watermark xuất hiện ở mọi sản phẩm Claude, dù người dùng tạo nội dung qua giao diện nào.
Với hình ảnh, Claude chèn metadata có chữ ký số - một loại “hộ chiếu số” của file - theo chuẩn C2PA, một chuẩn mở dùng để xác thực nội dung số. Nhờ đó, người dùng có thể kiểm tra file có từng qua xử lý của Claude hay không và phát hiện dấu hiệu chỉnh sửa. Bảng dưới đây so sánh hai cơ chế nhận diện:
| Tiêu chí | Watermark văn bản | Metadata chữ ký số |
|---|---|---|
| Áp dụng cho | Mọi văn bản do Claude tạo | File .svg, .png, .jpg |
| Cách hoạt động | Nhúng ẩn trong chuỗi văn bản | Gắn dữ liệu nguồn gốc có chữ ký số |
| Chuẩn kỹ thuật | Nội bộ của Anthropic | C2PA (chuẩn mở) |
| Khả năng giữ lại | Bám theo khi copy-paste, sót lại sau chỉnh sửa | Dễ mất khi chuyển đổi định dạng, chụp màn hình |
Vì sao Anthropic gắn nhãn AI đồng loạt vào lúc này?
Động thái của Anthropic diễn ra đúng thời điểm Đạo luật AI của Liên minh châu Âu (EU AI Act) chính thức áp dụng điều khoản minh bạch nội dung AI (Điều 50) từ ngày 2/8. Quy định yêu cầu nhà cung cấp mô hình AI phải gắn nhãn nhận diện nội dung do AI tạo ra theo định dạng máy đọc được. Anthropic nằm trong nhóm tổ chức ký Bộ quy tắc ứng xử về tính minh bạch của nội dung AI - văn bản hướng dẫn thực thi Điều 50, phần 2.
Theo công bố của Ủy ban châu Âu, tính đến cuối tháng 7, khoảng 190 tổ chức đã ký bộ quy tắc này, gồm Google, Meta, Microsoft, OpenAI và Anthropic ở nhóm nhà cung cấp mô hình, cùng Lenovo, hãng hàng không Lufthansa và thương hiệu trang sức Bvlgari ở nhóm doanh nghiệp triển khai AI.
Phạm vi áp dụng và giới hạn của tính năng nhận diện
Tính năng nhận diện nội dung AI bao phủ toàn bộ hệ sinh thái Claude, gồm Claude Platform (API - giao diện lập trình cho nhà phát triển tích hợp AI vào ứng dụng), ứng dụng Claude, trợ lý lập trình Claude Code, công cụ cộng tác Claude Cowork và tính năng gắn thẻ Claude Tag. Nội dung người dùng tạo ra thông qua nhà cung cấp dịch vụ đám mây sử dụng Claude cũng được áp dụng. Riêng các phiên bản Claude phát hành trước 2/8, Anthropic cho biết vẫn đang nghiên cứu cách bổ sung và sẽ công bố tiến độ trong thời gian tới.
Anthropic cũng thẳng thắn nêu giới hạn của công nghệ. Nội dung có watermark chỉ cho thấy nó “có thể” đã qua AI xử lý, chứ không chứng minh được nguồn gốc, vì người dùng thường dùng Claude để dịch thuật, rà soát lỗi, tóm tắt hoặc chuyển đổi định dạng - khiến văn bản gốc không phải do AI tạo vẫn có thể mang nhãn. Ngược lại, nội dung do AI tạo vẫn có thể không có nhãn nếu bị dịch qua lại, viết lại, trộn lẫn hoặc bị chụp màn hình làm mất metadata.
Trung Quốc siết quản lý nhãn AI ra sao?
Không chỉ châu Âu, Trung Quốc cũng đang đẩy mạnh quản lý nhãn nhận diện nội dung AI. Tháng 9/2025, bốn bộ ngành Trung Quốc ban hành Biện pháp ghi nhãn nội dung do AI tạo ra, chính thức có hiệu lực kèm tiêu chuẩn quốc gia bắt buộc về phương pháp ghi nhãn. Cách tiếp cận của nước này là mô hình “nhãn hiện + nhãn ẩn”: nhãn hiện là thông báo người dùng nhìn thấy trực tiếp, nhãn ẩn được nhúng kỹ thuật vào file dữ liệu - tương tự watermark của Anthropic. Khảo sát của báo chí Trung Quốc cho thấy các nền tảng AI và mạng xã hội lớn đã phổ cập nhãn hiện.
Về thực thi, tháng 4/2026, Bộ Công nghiệp và Công nghệ thông tin Trung Quốc (MIIT) đã xử lý ứng dụng chỉnh video Jianying, ứng dụng Maoxiang và website Jimeng AI vì không thực hiện đúng quy định ghi nhãn, với các hình thức gồm nhắc nhở, yêu cầu sửa chữa, cảnh cáo và xử lý người chịu trách nhiệm. Từ tháng 5/2026, Cơ quan quản lý không gian mạng Trung Quốc (CAC) phát động chiến dịch “Thanh Lang - Clear and Bright” kéo dài 4 tháng, đưa việc gắn nhãn nội dung AI không đầy đủ vào danh sách vấn đề trọng tâm cần xử lý.
Ý nghĩa với người dùng Việt Nam
Với người dùng Việt Nam - nơi Claude và các trợ lý AI ngày càng được dùng phổ biến trong công việc, học tập và sáng tạo nội dung - tính năng mới giúp việc kiểm tra nguồn gốc nội dung AI trở nên rõ ràng hơn. Văn bản do Claude tạo ra giờ có thể được nhận diện bằng watermark vô hình, còn ảnh do Claude sinh ra có thể được xác minh qua metadata chuẩn C2PA. Điều này đặc biệt hữu ích với nhà báo, nhà nghiên cứu, giáo viên và người làm tiếp thị khi cần phân biệt nội dung do con người viết với nội dung AI tạo ra. Người dùng cũng nên nhớ: chưa phát hiện watermark không có nghĩa nội dung chắc chắn do người viết, và nội dung có watermark cũng chưa chắc toàn bộ đều do AI tạo ra.
Theo East Money
Ảnh: Tara Winstead / Pexels
