Back to top
  • 공유 Chia sẻ
  • 인쇄 In
  • 글자크기 Cỡ chữ
URL đã được sao chép

Từ ngày 2/8, EU buộc nội dung AI tạo sinh gắn watermark

Tài liệu quy định và điện thoại di động tại một văn phòng ở Brussels / TokenPost.ai

Nghĩa vụ minh bạch trong Luật Trí tuệ nhân tạo (AI) của Liên minh châu Âu (EU) chính thức áp dụng từ ngày 2, biến công nghệ gắn watermark – dấu hiệu máy có thể đọc được – trên nội dung do AI tạo sinh tạo ra thành bài toán tuân thủ quan trọng đối với các công ty AI lớn. Anthropic cho biết đang tìm hiểu công nghệ watermark, nhưng chưa chính thức công bố đã áp dụng công nghệ này cho toàn bộ dòng sản phẩm Claude.

Crypto Briefing đưa tin Anthropic đã cài watermark vô hình vào các mô hình Claude trên toàn cầu. Tuy nhiên, trang Trung tâm minh bạch (Transparency Hub) mà Anthropic cập nhật ngày 29 tháng 1 chỉ nêu rằng công ty đang tiếp tục nghiên cứu watermark cùng giới công nghiệp và học thuật.

Trên Trung tâm minh bạch, Anthropic viết watermark "hiện được áp dụng phổ biến nhất cho đầu ra hình ảnh, vốn chưa được công ty cung cấp". Xét theo những gì công ty công khai, thông tin cho rằng Anthropic đã triển khai watermark trên toàn bộ dòng Claude vẫn chưa được xác nhận.

Đằng sau tranh cãi này là Điều 50 của Luật AI EU, quy định giọng nói, hình ảnh, video và văn bản do AI tạo ra hoặc chỉnh sửa phải được đánh dấu ở định dạng máy có thể đọc được.

Với deepfake và một số dạng văn bản mang tính thông tin công ích, doanh nghiệp còn phải gắn thêm cảnh báo mà người dùng có thể nhận biết trực tiếp. Khi nghĩa vụ minh bạch của Luật AI EU mà TokenPost từng đưa tin trước đó bước vào giai đoạn áp dụng thực tế, việc chứng minh nguồn gốc và cách thức tạo ra nội dung trở thành bài toán tuân thủ mà doanh nghiệp phải giải quyết.

Ủy ban châu Âu (European Commission) công bố "Bộ quy tắc thực hành minh bạch về đánh dấu và gắn nhãn nội dung do AI tạo ra" vào ngày 10 tháng 6. Đây là bộ quy tắc tự nguyện, nhưng được thiết kế như công cụ thực tế giúp doanh nghiệp tuân thủ Điều 50 của Luật AI.

Các doanh nghiệp thường kết hợp nhãn hiển thị cho người dùng, dữ liệu metadata của tệp và watermark vô hình. Watermark chèn tín hiệu nhận diện vào chính nội dung, trong khi metadata ghi lại lịch sử tạo, chỉnh sửa và thông tin chữ ký số vào tệp.

Google thông báo ký Bộ quy tắc thực hành minh bạch của Luật AI EU vào ngày 24 tháng 7, đồng thời giới thiệu SynthID là công nghệ watermark kỹ thuật số của mình. Công ty cũng bày tỏ lo ngại về việc quy định có thể trở nên phức tạp hơn.

OpenAI thông báo vào ngày 19 tháng 5 rằng sẽ áp dụng chuẩn xác thực nguồn gốc và tính xác thực nội dung C2PA cùng SynthID cho hình ảnh tạo ra từ ChatGPT, Codex và API. Đến ngày 31 tháng 7, công ty mở rộng watermark SynthID sang cả các định dạng âm thanh được hỗ trợ.

Cách ứng phó của cả hai công ty đều tập trung vào hình ảnh và âm thanh. Với các định dạng này, tín hiệu nhận diện có thể được chèn vào pixel hoặc tín hiệu âm thanh, nhưng văn bản lại dễ bị thay đổi cấu trúc câu khi dịch thuật hoặc viết lại.

Trong tài liệu công bố năm 2024, OpenAI thừa nhận watermark văn bản dễ bị vô hiệu hóa khi nội dung được dịch, viết lại câu hoặc chuyển đổi qua một mô hình tạo sinh khác. Điều này có nghĩa là dù tín hiệu nhận diện được chèn vào câu văn do AI tạo ra, tín hiệu đó có thể suy yếu nếu người dùng thay đổi cách diễn đạt.

Anthropic cũng từng vướng tranh cãi liên quan đến dấu hiệu ẩn trong Claude Code. Một bài viết kỹ thuật công bố ngày 30 tháng 6 chỉ ra rằng Claude Code đã chèn dấu hiệu không công khai vào system prompt, và cộng đồng lập trình viên gọi đây là "prompt steganography" (giấu tin trong prompt).

The Register đưa tin một kỹ sư của Anthropic mô tả đây là một thử nghiệm và cho biết sẽ gỡ bỏ. Vụ việc cho thấy bài toán cần phân định rõ giữa việc đánh dấu nội dung để tuân thủ quy định và những dấu hiệu nội bộ không công khai cho người dùng, đồng thời phải giải thích minh bạch mục đích và phạm vi áp dụng.

Ngành công nghiệp tài sản số cũng cần lưu ý bài toán tương tự khi dùng AI agent trong các sàn giao dịch, ví điện tử, kiểm toán bảo mật và nghiên cứu: phải xác minh nguồn gốc và khả năng bị chỉnh sửa của kết quả đầu ra. Tương tự vấn đề quyền truy cập hạ tầng thực tế và kiểm soát quyền hạn của AI agent, chỉ riêng watermark không đủ để đảm bảo độ tin cậy của hồ sơ công việc, nên cần quản lý đồng thời quyền truy cập và nhật ký thực thi.

Hiện tại, lập trường công khai của Anthropic vẫn đang ở giai đoạn tìm hiểu công nghệ watermark. Việc có áp dụng thực tế cho Claude hay không, và phạm vi áp dụng ra sao, sẽ chỉ được xác định khi công ty đưa ra thông báo chính thức riêng.

<Bản quyền ⓒ TokenPost, nghiêm cấm sao chép và phân phối trái phép>

Phổ biến nhất

Các bài viết liên quan khác

Bình luận 0

Mẹo bình luận

Bài viết tuyệt vời. Mong có bài tiếp theo. Phân tích xuất sắc.

0/1000

Mẹo bình luận

Bài viết tuyệt vời. Mong có bài tiếp theo. Phân tích xuất sắc.
1