Back to top
  • 공유 Chia sẻ
  • 인쇄 In
  • 글자크기 Cỡ chữ
URL đã được sao chép

AI học dữ liệu: Các báo phản bác Bộ Tư pháp Mỹ

Hồ sơ pháp lý đặt trong phòng xử án của tòa án liên bang Mỹ / TokenPost.ai

Các hãng truyền thông Mỹ cho rằng tòa án chỉ nên xem xét hạn chế bản ý kiến của Bộ Tư pháp Mỹ về việc sử dụng tác phẩm có bản quyền để huấn luyện trí tuệ nhân tạo (AI) theo nguyên tắc sử dụng hợp lý.

Bộ Tư pháp Mỹ ngày 1 tháng 9 đã nộp bản trình bày lợi ích tại Tòa án Quận phía Nam New York, khẳng định việc huấn luyện mô hình ngôn ngữ lớn (LLM) bằng văn bản có bản quyền về nguyên tắc không vi phạm luật bản quyền. Cơ quan này viện dẫn năng lực cạnh tranh của ngành AI và an ninh quốc gia, đồng thời cho rằng việc sao chép tác phẩm có bản quyền trong quá trình huấn luyện là hành vi sử dụng 'mang tính chuyển đổi'.

Bộ Tư pháp Mỹ phân biệt giai đoạn huấn luyện với giai đoạn AI tái hiện tác phẩm có bản quyền trong câu trả lời dành cho người dùng. Theo lập luận này, quá trình huấn luyện số hóa từ vựng, ngữ pháp và mối liên hệ tri thức trong tài liệu để tạo ra câu trả lời mới, còn việc tái cấu trúc và phân phối một tác phẩm cụ thể trên thực tế cần được đánh giá riêng.

New York Times (The New York Times) cùng các nguyên đơn khác đã nộp văn bản phản hồi ngày 28 tháng 9, cho rằng bản ý kiến của Bộ Tư pháp Mỹ thiên về lập luận chính sách hơn là phân tích pháp lý dựa trên bằng chứng. Các nguyên đơn cũng cho rằng quan điểm này mâu thuẫn với lập trường trước đây của Cơ quan Bản quyền Mỹ và chưa xem xét đầy đủ khả năng vận hành thực tế của thị trường cấp phép giữa chủ sở hữu bản quyền và các công ty AI.

Phía nguyên đơn chỉ ra rằng chính phủ nhấn mạnh năng lực cạnh tranh của ngành AI và an ninh quốc gia nhưng chưa giải quyết đầy đủ vấn đề bồi thường cho chủ sở hữu bản quyền. Ngược lại, Bộ Tư pháp Mỹ tập trung vào sự khác biệt về chức năng và tác động giữa tài liệu được dùng để huấn luyện và nội dung đầu ra cung cấp cho người dùng.

Vụ án do thẩm phán Sidney H. Stein của Tòa án Quận phía Nam New York phụ trách. Vụ việc đang được xử lý theo thủ tục tố tụng hợp nhất đa quận (MDL), bao gồm nhiều tranh chấp bản quyền do OpenAI cùng các hãng truyền thông và tác giả khởi xướng.

Bản trình bày lợi ích của Bộ Tư pháp Mỹ là thủ tục để chính phủ giải thích lợi ích công hoặc quan điểm chính sách với tòa án. Đây không phải phán quyết hay mệnh lệnh có tính ràng buộc, vì vậy mức độ tòa án xem xét các lập luận trong văn bản sẽ do hội đồng xét xử quyết định.

Tòa án phải xem xét hai vấn đề chính. Thứ nhất là việc sao chép tác phẩm có bản quyền để huấn luyện mô hình AI có cấu thành sử dụng hợp lý hay không. Thứ hai là việc AI tạo ra bản tóm tắt hoặc câu trả lời tương tự bài báo có làm giảm lượt truy cập bản gốc và thay thế thị trường quảng cáo, thuê bao hay không.

Luật bản quyền Mỹ đánh giá sử dụng hợp lý dựa trên tổng hợp mục đích và tính chất sử dụng, đặc điểm của tác phẩm, khối lượng sử dụng và tác động đến thị trường của tác phẩm gốc. Vì vậy, đặc điểm của tài liệu được dùng để huấn luyện, cách thức sử dụng và tác động thị trường của nội dung đầu ra đều có thể trở thành đối tượng tranh tụng.

Bộ Tư pháp Mỹ cho rằng việc sao chép để huấn luyện phục vụ chức năng khác với tác phẩm gốc nên có tính 'chuyển đổi rất cao'. Trong khi đó, các hãng truyền thông lập luận rằng dịch vụ AI có thể tóm tắt nội dung bài báo hoặc cung cấp dưới dạng câu trả lời, khiến độc giả không còn tìm đến bài viết gốc.

Trọng tâm đối đầu giữa hai bên là liệu việc thu thập dữ liệu huấn luyện và tác động thay thế thị trường của nội dung AI nên được xem là một vấn đề thống nhất hay tách thành các vấn đề riêng biệt.

Việc Bộ Tư pháp Mỹ nộp bản ý kiến không có nghĩa mọi hoạt động huấn luyện AI đều trở nên hợp pháp. Chính văn bản này cũng nêu rằng đánh giá sử dụng hợp lý có thể thay đổi tùy cách sử dụng cụ thể. Phương thức thu thập không được cho phép, việc sử dụng nội dung trả phí hoặc không công khai và đầu ra tái hiện tác phẩm gốc vẫn có thể phải chịu đánh giá pháp lý riêng.

Vụ án có thể tác động đến các cuộc đàm phán cấp phép giữa công ty AI và hãng truyền thông. Nếu việc sao chép trong giai đoạn huấn luyện được cho phép rộng hơn, chi phí thu thập dữ liệu và cơ cấu bồi thường có thể thay đổi. Tuy nhiên, nếu nội dung đầu ra bị xác định là thay thế thị trường của tác phẩm gốc, phạm vi trách nhiệm của doanh nghiệp có thể tăng lên.

Tại Việt Nam, các dịch vụ AI tạo sinh ngày càng được sử dụng để tóm tắt và tái cấu trúc bài báo, nội dung, nên phán quyết này có thể trở thành một điểm tham khảo khi xem xét mối quan hệ giữa dữ liệu huấn luyện AI và bản quyền. Dù vậy, phán quyết của tòa án Mỹ không được áp dụng nguyên trạng vào quan hệ pháp lý tại Việt Nam, trong khi các bên trực tiếp của vụ án là doanh nghiệp và hãng truyền thông Mỹ.

Cuối cùng, mức độ tòa án coi trọng quan điểm của chính phủ sẽ được xác định trong quá trình xét xử. Cách tòa án phân biệt việc sao chép dữ liệu huấn luyện với tác động thay thế thị trường của nội dung AI vẫn là vấn đề then chốt trong các bước tiếp theo của vụ án.

<Bản quyền ⓒ TokenPost, nghiêm cấm sao chép và phân phối trái phép>

Phổ biến nhất

Các bài viết liên quan khác

Bình luận 0

Mẹo bình luận

Bài viết tuyệt vời. Mong có bài tiếp theo. Phân tích xuất sắc.

0/1000

Mẹo bình luận

Bài viết tuyệt vời. Mong có bài tiếp theo. Phân tích xuất sắc.
1