Anthropic vừa quyết định gắn dấu nhận diện vô hình, có thể đọc được bằng máy, lên nội dung do Claude tạo ra. Đây là bước đi giúp phân biệt rõ hơn đâu là văn bản, file do AI tạo và đâu là nội dung do con người viết.
Theo tài liệu hỗ trợ của Claude, kể từ ngày 2/8/2026, các mô hình Claude mới ra mắt tại Liên minh châu Âu (EU) sẽ hỗ trợ dấu nhận diện dạng máy đọc ngay từ thời điểm phát hành. Với văn bản, Claude sẽ chèn một watermark ẩn vào bên trong nội dung. Với file, hệ thống sẽ gắn kèm metadata nguồn gốc được ký số.
Tính năng này áp dụng cho Claude Platform API, ứng dụng Claude, Claude Code, Claude Cowork và Claude Tag. Ở những khu vực có mô hình hỗ trợ, dấu nhận diện sẽ được áp dụng trên phạm vi toàn cầu.
Người dùng truy cập các mô hình hỗ trợ thông qua Amazon Web Services (AWS), Google Cloud hay Microsoft (MSFT) Foundry cũng sẽ nhận được watermark trong văn bản đầu ra. Đây không phải là nhãn hiển thị trên giao diện dịch vụ, mà là tín hiệu được chèn thẳng vào nội dung do mô hình tạo ra.
Động thái này gắn liền với nghĩa vụ minh bạch theo Đạo luật Trí tuệ nhân tạo của EU (EU AI Act). Anthropic cho biết công ty đã ký Bộ quy tắc thực hành về minh bạch nội dung do AI tạo ra, theo Điều 50(2) của đạo luật này, và đang đưa cam kết đó vào các sản phẩm thuộc hệ sinh thái Claude.
TokenPost từng đưa tin rằng văn bản và file do Claude tạo ra sẽ được gắn dấu nhận diện vô hình. Điểm mới trong thông tin lần này là cách phân loại rõ ràng hơn giữa phương thức đánh dấu văn bản và file, cùng việc mở rộng phạm vi áp dụng ra toàn cầu ở những nơi có mô hình hỗ trợ.
Watermark trong văn bản không phải là nhãn hiển thị trên màn hình. Anthropic giải thích rằng khi mô hình hỗ trợ tạo câu trả lời, một dấu hiệu mà con người không thể nhận biết bằng mắt thường sẽ được chèn ngay trong câu chữ. Công ty khẳng định dấu hiệu này không làm thay đổi ý nghĩa, chất lượng hay độ dễ đọc của nội dung.
Với file, Anthropic dùng phương thức khác. Khi Claude tạo ra các file định dạng .svg, .png, .jpg, hệ thống sẽ gắn kèm metadata nguồn gốc được ký số theo chuẩn C2PA — tiêu chuẩn dùng để ghi lại nguồn gốc và lịch sử chỉnh sửa của nội dung.
Nếu metadata này còn được giữ nguyên, người dùng có thể dùng nó để kiểm tra một file có từng qua Claude hay không, và file đó đã bị chỉnh sửa sau đó hay chưa. Tuy nhiên, metadata có thể mất đi trong quá trình đổi định dạng file hoặc lưu lại từ đầu.
Watermark cũng không phải công cụ xác định tuyệt đối. Anthropic cho biết dấu hiệu được phát hiện chỉ là tín hiệu cho thấy khả năng nội dung từng qua xử lý của Claude, chứ không tự nó khẳng định toàn bộ nguồn gốc của nội dung. Nguyên nhân là bởi ngay cả khi con người chỉ dùng Claude để hiệu đính, dịch thuật, tóm tắt hay chuyển đổi định dạng file, dấu hiệu vẫn có thể xuất hiện trên kết quả cuối cùng.
Ngược lại, việc không phát hiện dấu hiệu cũng không có nghĩa nội dung không do AI tạo ra. Trường hợp nội dung được tạo từ các mô hình ra đời trước khi có tính năng watermark, hoặc câu chữ bị chỉnh sửa, diễn giải lại, dịch thuật nhiều, hoặc bị trộn lẫn với văn bản khác, hay đoạn văn quá ngắn, thì tín hiệu đáng tin cậy có thể không còn tồn tại.
Đối với người dùng, một điểm đáng lưu ý là kết quả từ Claude vẫn có thể bị nhận diện ngay cả sau khi rời khỏi giao diện dịch vụ. Văn bản được sao chép sang tài liệu, email hay website vẫn có thể giữ lại một phần dấu hiệu. Ngược lại, chỉ dựa vào kết quả phát hiện cũng khó có thể khẳng định chắc chắn ai là người viết và quá trình tạo ra nội dung diễn ra như thế nào.
Anthropic cho biết công ty sẽ hỗ trợ người dùng và bên thứ ba trong việc phát hiện watermark cũng như metadata nguồn gốc của Claude. Phương thức phát hiện cụ thể sẽ được công bố trong tài liệu kỹ thuật trong thời gian tới.
Bình luận 0