Anthropic bắt đầu gắn 'watermark' không thể nhìn thấy bằng mắt thường nhưng máy có thể đọc được vào văn bản do Claude tạo ra và một số tệp tin đi kèm. Ngay cả khi người dùng sao chép nội dung này sang tài liệu hay trang web khác, một số tín hiệu vẫn có thể còn sót lại.
Theo tài liệu hướng dẫn chính thức của Claude, Anthropic cho biết công ty chèn dấu hiệu máy có thể đọc được vào văn bản do các mô hình được hỗ trợ tạo ra.
Watermark không hiển thị dưới dạng nhãn riêng trên màn hình, mà được đưa trực tiếp vào câu chữ được tạo ra. Cơ chế này được thiết kế để không làm thay đổi ý nghĩa, chất lượng hay khả năng đọc của văn bản.
Khi người dùng chuyển câu trả lời của Claude sang văn bản Word, email, mạng xã hội hay một trang web khác, watermark vẫn có thể đi theo. Ngay cả khi câu chữ được chỉnh sửa một phần, hệ thống vẫn có khả năng phát hiện ra dấu hiệu này.
Phạm vi áp dụng không chỉ giới hạn ở dịch vụ web của Claude. Nếu sử dụng các mô hình được hỗ trợ, văn bản tạo ra qua API, Claude Code, Cowork và Claude Tag cũng mang cùng dấu hiệu.
Quy định này cũng áp dụng cho trường hợp sử dụng các mô hình được hỗ trợ thông qua Amazon Web Services(AWS), Google Cloud và Microsoft Foundry của Microsoft(MSFT). Nguyên nhân là watermark được chèn ở cấp độ mô hình, chứ không phải ở giao diện dịch vụ.
Với tệp tin, Anthropic áp dụng cách làm khác so với văn bản. Công ty chèn metadata nguồn gốc có chữ ký số vào một số định dạng như SVG, PNG và JPG.
Metadata này sử dụng tiêu chuẩn mở 'C2PA', dùng để xác nhận nguồn gốc và lịch sử chỉnh sửa của nội dung số. Tệp có chữ ký hợp lệ của Claude có thể được các công cụ bên ngoài dùng làm căn cứ để xác định nội dung có được xử lý bởi Claude hay không, và có bị chỉnh sửa sau đó hay không.
Tuy nhiên, một số nền tảng đám mây hoặc định dạng tệp có thể không hỗ trợ chữ ký metadata nguồn gốc. Vì vậy, phạm vi áp dụng của watermark văn bản và dấu hiệu nguồn gốc tệp tin có thể khác nhau.
Động thái này diễn ra trong bối cảnh Điều 50 của Đạo luật AI Liên minh châu Âu (EU) quy định nghĩa vụ minh bạch. Ủy ban châu Âu cho biết trong bộ quy tắc thực hành về minh bạch nội dung do AI tạo ra rằng nghĩa vụ theo Điều 50 có hiệu lực từ ngày 2 tháng 8 năm 2026, quy định việc gắn nhãn và phát hiện nội dung do AI tạo ra hoặc chỉnh sửa.
Anthropic cho biết các mô hình Claude mới ra mắt tại EU sau ngày 2 tháng 8 sẽ hỗ trợ dấu hiệu máy có thể đọc được ngay từ ngày đầu ra mắt. Phạm vi áp dụng sẽ mở rộng ra toàn bộ dịch vụ Claude trên thế giới có sử dụng các mô hình được hỗ trợ, đồng thời tính năng này cũng sẽ được bổ sung dần cho các mô hình hiện có.
TokenPost trước đó đưa tin rằng việc Đạo luật AI của EU có hiệu lực đã khiến công nghệ watermark cho AI tạo sinh trở thành một bài toán ứng phó quy định. Nếu các công cụ phát hiện AI trước đây chủ yếu dựa vào văn phong hay xác suất từ ngữ để suy đoán nội dung có phải do AI viết hay không, thì cách làm của Claude khác ở chỗ tín hiệu được chèn ngay từ giai đoạn tạo ra văn bản.
Các trường học, cơ quan truyền thông và hệ thống nội bộ doanh nghiệp có thể sử dụng tín hiệu này làm dữ liệu tham khảo để kiểm chứng nội dung. Tuy nhiên, chỉ riêng việc phát hiện watermark không đủ để khẳng định toàn bộ văn bản là do Claude viết ra.
Nguyên nhân là dấu hiệu này cũng có thể xuất hiện trong trường hợp một bài viết do con người soạn thảo được Claude chỉnh sửa, dịch hoặc tóm tắt lại. Kết quả phát hiện có thể là manh mối để xác minh quá trình tạo nội dung, nhưng khó dùng làm căn cứ duy nhất.
Nếu văn bản bị chỉnh sửa quy mô lớn, viết lại, dịch thuật hoặc trộn lẫn với nội dung khác, khả năng phát hiện watermark ổn định có thể giảm đi. Câu văn ngắn thường không đủ để chứa tín hiệu, còn tệp tin cũng có thể mất metadata trong quá trình lưu lại, đổi định dạng hay chụp màn hình. Anthropic cho biết công ty đang phát triển công cụ để người dùng bên ngoài và bên thứ ba có thể phát hiện dấu hiệu của Claude, tài liệu kỹ thuật chi tiết sẽ được công bố sau.
Bình luận 0