Anthropic bắt đầu gắn watermark (thủy vân) vô hình, có thể nhận dạng bằng máy, vào văn bản do Claude tạo ra. Kể từ ngày 2 tháng 8 năm 2026, các mô hình ra mắt tại Liên minh châu Âu (EU) sẽ hỗ trợ tính năng này ngay từ thời điểm phát hành, còn các mô hình hiện có sẽ được bổ sung dần.
Anthropic cho biết trong tài liệu hỗ trợ rằng công ty tích hợp watermark dạng nhúng vào văn bản do Claude tạo ra. Với các định dạng file được hỗ trợ, công ty còn gắn thêm metadata nguồn gốc dạng chữ ký số, giúp xác nhận xuất xứ và lịch sử chỉnh sửa của nội dung.
Phạm vi áp dụng gồm Claude Platform API cùng các sản phẩm Claude, Claude Code, Claude Cowork và Claude Tag. Tính năng này được triển khai trên toàn cầu, tại mọi khu vực có cung cấp các mô hình hỗ trợ.
Watermark văn bản cũng được áp dụng khi người dùng sử dụng các mô hình hỗ trợ thông qua Amazon Web Services (AWS), Google Cloud hay Microsoft($MSFT) Foundry. Thay vì gắn trên giao diện dịch vụ, watermark được nhúng trực tiếp vào phần nội dung do mô hình tạo ra.
Đối với file, cách xử lý khác với văn bản thuần. Các định dạng file được hỗ trợ sẽ được bổ sung metadata nguồn gốc kèm chữ ký số, cho phép xác nhận file đó có được xử lý qua Claude hay không.
Thông báo lần này cụ thể hóa nội dung trong bài viết trước đó của báo về phạm vi áp dụng watermark cho văn bản và file do Claude tạo ra. Những vấn đề còn bỏ ngỏ ở giai đoạn đưa tin trước đó, như việc watermark có phủ toàn bộ dòng sản phẩm hay không và phạm vi áp dụng trên các dịch vụ đám mây, nay đã được làm rõ qua tài liệu hỗ trợ chính thức của Anthropic.
Watermark không thể nhìn thấy bằng mắt thường và không làm thay đổi ý nghĩa, chất lượng hay khả năng đọc của văn bản. Dấu hiệu này vẫn có thể được truy vết sau khi sao chép, dán lại, và có thể còn sót lại trong những đoạn văn đã qua chỉnh sửa một phần.
Tuy nhiên, việc viết lại toàn diện, dịch thuật, câu quá ngắn hoặc trộn lẫn với nội dung khác có thể làm giảm khả năng phát hiện watermark. Metadata nguồn gốc gắn trong file cũng khó xác minh nếu bị xóa bỏ.
Anthropic giải thích rằng ngay cả khi phát hiện được watermark, điều đó cũng không phải bằng chứng cho thấy toàn bộ văn bản do Claude viết ra. Bởi lẽ dấu hiệu này vẫn có thể tồn tại ngay cả khi Claude chỉ tham gia một phần vào việc hiệu đính, dịch thuật, tóm tắt hay chuyển đổi file.
Ngược lại, việc không phát hiện được watermark cũng không thể khẳng định nội dung đó do con người viết. Đầu ra từ các mô hình cũ chưa hỗ trợ watermark, hoặc nội dung đã bị chỉnh sửa nhiều, có thể khiến dấu hiệu biến mất hoặc không thể phát hiện được.
Động thái này nhằm đáp ứng nghĩa vụ minh bạch theo Đạo luật AI của EU, có hiệu lực từ ngày 2 tháng 8. Điều 50 của đạo luật này yêu cầu các nội dung âm thanh, hình ảnh, video và văn bản do AI tạo ra hoặc chỉnh sửa phải được đánh dấu theo định dạng máy có thể đọc được.
Kể từ khi Đạo luật AI của EU có hiệu lực, watermark AI tạo sinh đã trở thành bài toán tuân thủ đối với nhiều doanh nghiệp lớn, nhưng watermark văn bản khó duy trì và nhận dạng hơn so với hình ảnh hay video. Văn bản có đặc điểm là dễ bị thay đổi hình thái gốc trong quá trình sao chép, trích dẫn, tóm tắt hay dịch thuật.
Google DeepMind đang áp dụng watermark vô hình cho hình ảnh, âm thanh, văn bản và video thông qua công nghệ SynthID. Substack đã ra mắt tính năng ước tính khả năng một bài viết hoặc bình luận được tạo bởi AI, còn YouTube tăng cường hiển thị nhãn công khai việc sử dụng AI.
Cách các nền tảng phản ứng đang chuyển dịch theo hướng đánh dấu nguồn gốc nội dung và phát hiện khả năng AI tham gia, thay vì ngăn chặn việc sử dụng AI tạo sinh một cách đồng loạt. Các mô hình Claude hiện có sẽ được đưa vào diện hỗ trợ watermark theo từng giai đoạn chuyển tiếp.
Nguồn xác minh: tài liệu hỗ trợ của Anthropic, Ủy ban châu Âu, SynthID của Google DeepMind, trang trợ giúp Substack, blog YouTube, The Verge
Bình luận 0