wikiHow vừa kiện OpenAI ra tòa án Mỹ, cáo buộc công ty này dùng hơn 11.000 bài viết dạng hướng dẫn của wikiHow để huấn luyện ChatGPT(ChatGPT) mà không xin phép. Vụ việc một lần nữa đưa ranh giới sử dụng nội dung web công khai làm dữ liệu huấn luyện AI tạo sinh trở thành tâm điểm tranh cãi pháp lý.
Trang theo dõi kiện tụng AI The World of AI cho biết wikiHow đã nộp đơn kiện bản quyền nhắm vào OpenAI(OpenAI) tại tòa án liên bang khu vực Nam New York, Mỹ, vào ngày 21 (giờ địa phương). Vụ kiện mang số hiệu 1:26-cv-07171 và hiện ở trạng thái mới tiếp nhận.
Theo hãng tin chuyên về pháp lý Law360(Law360), wikiHow cáo buộc OpenAI sao chép nội dung của mình ở quy mô lớn. wikiHow cho rằng OpenAI đã dùng hơn 11.000 bài viết hướng dẫn của họ để huấn luyện ChatGPT, trong đó ít nhất 1.200 bài là tác phẩm đã đăng ký bản quyền.
Vấn đề không chỉ dừng ở khâu huấn luyện. wikiHow cho rằng ChatGPT còn tạo ra những câu trả lời gần như sao chép nguyên văn phong cách nội dung hướng dẫn đặc trưng của wikiHow. Nếu đúng, đây không còn là chuyện dùng dữ liệu huấn luyện thông thường, mà là việc kết quả do AI tạo ra có thể cạnh tranh trực tiếp với chính thị trường của tác phẩm gốc.
wikiHow là nền tảng chuyên tổng hợp thông tin đời sống và hướng dẫn thực hành theo từng bước. Đây cũng chính là mảng nội dung mà ChatGPT có thể trả lời ngay khi người dùng đặt câu hỏi. Vì vậy, vụ kiện lần này không chỉ xoay quanh cách thu thập dữ liệu huấn luyện, mà còn đặt vấn đề liệu kết quả do AI tạo ra có thể thay thế hoàn toàn nội dung gốc hay không.
Trong các vụ kiện bản quyền, nguyên tắc “sử dụng hợp lý” (fair use) cho phép dùng tác phẩm mà không cần xin phép trong một số trường hợp ngoại lệ, dựa trên mục đích, tính chất sử dụng, mức độ sử dụng và ảnh hưởng đến thị trường của tác phẩm gốc. Với các vụ liên quan đến AI tạo sinh, câu hỏi cốt lõi thường là việc thu thập và huấn luyện trên khối lượng lớn dữ liệu web công khai có mang tính “biến đổi” hay không, và liệu nó có thay thế nhu cầu đối với nội dung gốc hay không.
Vụ kiện này bổ sung thêm một trường hợp mới vào loạt tranh chấp bản quyền liên quan đến AI đang dồn về tòa án khu vực Nam New York. Trong bối cảnh các vụ kiện từ báo chí, nhà văn và nhà xuất bản đã và đang diễn ra, việc một nền tảng nội dung hướng dẫn đời sống cũng lên tiếng cho thấy phạm vi tranh chấp đang ngày càng mở rộng.
Lập trường trực tiếp của OpenAI về vụ kiện này hiện chưa được xác nhận. Tuy nhiên, trong các tranh chấp bản quyền trước đó với New York Times(The New York Times), OpenAI từng khẳng định việc huấn luyện trên dữ liệu công khai thuộc phạm vi sử dụng hợp lý. Nhiều khả năng lập luận này sẽ tiếp tục là trọng tâm tranh luận trong vụ kiện lần này.
Nội dung mà wikiHow đưa ra khiếu nại có tính chất khác với các bài báo thời sự hay tác phẩm văn học. Thay vì tường thuật một sự kiện cụ thể hay mang tính hư cấu, đây là dạng nội dung thực dụng, trình bày quy trình và cách làm từng bước cho các vấn đề đời sống. Cách tòa án nhìn nhận loại nội dung này trong bối cảnh cạnh tranh giữa huấn luyện AI và đầu ra AI sẽ là yếu tố then chốt của vụ việc.
Theo thống kê của trang IP Feed, OpenAI hiện có tên trong 27 vụ kiện sở hữu trí tuệ liên bang tại Mỹ, trong đó 16 vụ đang được thụ lý. Vụ kiện của wikiHow cũng nằm trong danh sách này. Con số này được tổng hợp với sự hỗ trợ của AI nên có giới hạn nhất định, nhưng vẫn cho thấy các tranh chấp bản quyền quanh OpenAI đang tích lũy chứ không dừng ở một vụ đơn lẻ.
Vụ kiện lần này không liên quan trực tiếp đến tiền mã hóa. Tuy nhiên, nó gắn liền với chi phí dữ liệu huấn luyện AI, phạm vi cho phép thu thập dữ liệu web (web crawling) và cấu trúc đàm phán cấp phép nội dung — những yếu tố có thể ảnh hưởng đến cơ cấu chi phí của cả ngành công nghệ. Tác động thực tế nhiều khả năng chỉ rõ ràng sau khi tòa án đưa ra phán quyết về sử dụng hợp lý và phạm vi lệnh cấm (nếu có).
Tại thị trường trong nước, tranh luận quanh dữ liệu huấn luyện AI và bản quyền cũng đang lan sang toàn bộ khối doanh nghiệp nền tảng và nội dung. TokenPost từng đưa tin tranh cãi về việc Amazon số hóa sách hiếm đã mở rộng cuộc đua thu thập dữ liệu huấn luyện AI sang cả vấn đề bảo tồn ấn phẩm giấy. Vụ kiện của wikiHow là một biến thể khác của cùng cuộc tranh luận đó, lần này chuyển sang thị trường nội dung hướng dẫn trực tuyến.
Liên minh châu Âu (EU) cũng đang xây dựng khung pháp lý yêu cầu các nhà cung cấp mô hình AI đa dụng phải tuân thủ chính sách bản quyền và công khai tóm tắt nội dung dữ liệu huấn luyện. Như TokenPost từng phản ánh qua trường hợp áp dụng quy định thực thi AI đa dụng của EU, tính minh bạch của dữ liệu huấn luyện AI và tiêu chuẩn xử lý quyền lợi đang trở thành nghị trình quản lý mang tính quốc tế, song song với các vụ kiện tại Mỹ.
Theo thông tin công bố, wikiHow yêu cầu bồi thường thiệt hại đồng thời đề nghị tòa ban hành lệnh cấm để ngăn OpenAI tiếp tục sử dụng nội dung của mình trong tương lai. Tuy nhiên, ở mức độ tóm tắt công khai hiện tại, số tiền bồi thường cụ thể chưa được nêu rõ. Vụ kiện mới ở giai đoạn tiếp nhận, các tình tiết dự kiến sẽ được làm rõ hơn khi đơn kiện được công bố đầy đủ và OpenAI nộp văn bản phản hồi.
Bình luận 0