Anthropic sẽ áp dụng watermark thống kê cho văn bản do các mô hình Claude mới tạo ra, đồng thời triển khai lần lượt trong vài tháng tới với các mô hình ra mắt trước ngày 2 tháng 8 năm 2026.
Anthropic cho biết trong tài liệu giải thích chính thức ngày 14 tháng 8 rằng các mô hình Claude ra mắt trong tương lai sẽ được áp dụng watermark trên toàn cầu. Công ty đưa ra lý do khó tách biệt ổn định hệ thống triển khai theo từng khu vực.
Watermark không hoạt động bằng cách thêm ký hiệu có thể nhìn thấy hoặc ký tự ẩn vào văn bản. Khi Claude lựa chọn từ tiếp theo, hệ thống điều chỉnh cách chọn giữa các ứng viên có khác biệt về ý nghĩa không lớn để tạo ra một mẫu thống kê.
Công nghệ này được thiết kế để không gây thay đổi đáng kể đến chất lượng và khả năng đọc của câu văn đối với người dùng. Watermark không chứa thông tin có thể nhận diện người dùng, tổ chức hoặc nội dung cuộc trò chuyện.
Ngay cả khi xác nhận được watermark, kết quả chỉ cho thấy khả năng Claude đã tham gia tạo hoặc xử lý nội dung. Công nghệ không thể xác định nội dung do con người viết hay do một trí tuệ nhân tạo khác tạo ra.
Nền tảng kỹ thuật của hệ thống là phương pháp SynthID-Text do Google DeepMind giới thiệu trong nghiên cứu trên Nature năm 2024. Công nghệ này điều chỉnh cách lựa chọn token khi ý nghĩa của nhiều từ ứng viên không khác biệt lớn, qua đó tạo ra chữ ký thống kê.
Nghiên cứu trên Nature cho biết trong một thử nghiệm sử dụng khoảng 20 triệu câu trả lời của Gemini, chênh lệch đánh giá của người dùng giữa văn bản có và không có watermark không có ý nghĩa thống kê. Tuy nhiên, kết quả này chỉ là kiểm chứng đối với mô hình Google và môi trường thử nghiệm của Google, chưa đủ cơ sở để khẳng định kết quả tương tự sẽ xuất hiện ở mọi mô hình, ngôn ngữ và trường hợp sử dụng của Claude.
Với câu ngắn, câu nêu sự thật cần độ chính xác cao hoặc mã nguồn, số lượng lựa chọn ứng viên bị giới hạn nên độ tin cậy của việc phát hiện watermark có thể thấp hơn. Việc chỉnh sửa một phần văn bản vẫn có thể để lại dấu vết, nhưng viết lại toàn bộ câu có thể làm suy yếu watermark.
Watermark sẽ được áp dụng trong các tác vụ như dịch thuật, khi Claude tái tạo toàn bộ câu văn. Ngược lại, khả năng phát hiện có được duy trì sau khi viết lại hoàn toàn hoặc sau dịch thuật hay không vẫn cần được kiểm chứng trong môi trường sử dụng thực tế.
Bối cảnh thể chế của động thái này có liên quan đến Đạo luật AI của Liên minh châu Âu (EU). Ủy ban châu Âu giải thích trong tài liệu về quy định minh bạch của AI Act rằng nghĩa vụ gắn dấu hiệu máy đọc được vào nội dung do AI tạo ra hoặc thay đổi sẽ được áp dụng từ ngày 2 tháng 8.
Bộ quy tắc thực hành liên quan mang tính tự nguyện, nhưng nghĩa vụ pháp lý về việc đánh dấu nội dung do AI tạo ra vẫn được thực thi. Các mô hình Claude ra mắt trước ngày 2 tháng 8 được áp dụng thời gian chuyển tiếp, và Anthropic cho biết sẽ bổ sung watermark cho những mô hình này.
Trong bản cập nhật ngày 1 tháng 9, Anthropic cho biết sẽ cung cấp API phát hiện dưới hình thức xem trước riêng tư. Các đối tượng được ưu tiên gồm cơ quan quản lý, cơ quan điều tra, cơ quan báo chí, tổ chức kiểm chứng thông tin, viện nghiên cứu độc lập và cơ sở giáo dục. Công ty chưa nêu thời điểm mở API cho người dùng phổ thông.
API phát hiện chỉ là công cụ hỗ trợ để kiểm tra khả năng tồn tại của watermark. Anthropic giải thích rằng watermark không phải công cụ để xác định bản quyền, quyền sở hữu hoặc trách nhiệm pháp lý.
Trước đó, Anthropic đã công khai cách áp dụng watermark cho văn bản do Claude tạo ra, nhưng khi đó chưa có thông báo chính thức về việc triển khai trên toàn bộ dòng sản phẩm. Tài liệu lần này cụ thể hóa kế hoạch áp dụng cho các mô hình mới và triển khai lần lượt với các mô hình hiện có.
Động thái này không phải là biến số giá tức thời đối với thị trường tài sản số, mà gần hơn với cuộc cạnh tranh xoay quanh phương thức xác minh nguồn gốc nội dung AI tạo ra và tiêu chuẩn ngành. Các yếu tố cần theo dõi gồm độ chính xác của việc phát hiện watermark, khả năng duy trì dấu vết sau khi viết lại hoặc dịch thuật, quyền truy cập API phát hiện và khả năng tương tác giữa các dấu hiệu do các doanh nghiệp AI sử dụng.
Bình luận 0