Naver Hàn Quốc vừa thu hẹp phạm vi khai thác dữ liệu từ cả hai kênh: bài viết trên Cafe và dữ liệu lấy qua API tìm kiếm. Công ty chặn việc thu thập tự động bài viết Cafe để hiển thị trên dịch vụ bên ngoài, đồng thời cấm dùng dữ liệu từ API tìm kiếm để huấn luyện AI, tạo câu trả lời tự động hoặc bán lại cho bên thứ ba.
Theo DigitalToday đưa tin, Naver mới đây thông báo trên Cafe rằng việc thu thập hàng loạt bài viết, bình luận của hội viên và Cafe rồi đăng lại trên trang khác mà không có sự đồng ý sẽ bị cấm. Danh sách hành vi bị cấm còn bao gồm dùng crawler, bot, script để thu thập tự động, truy cập dữ liệu không qua kênh chính thức và tìm cách lách các biện pháp chặn của Naver.
Biện pháp này xuất phát từ việc một số trang web bên ngoài bị phát hiện tự động lấy bài đăng mua bán đồ cũ và bài viết thông tin từ Cafe của Naver để hiển thị trên dịch vụ riêng. Dù người dùng bấm vào bài viết vẫn được dẫn về Cafe gốc, nhưng các bên khai thác dữ liệu này vẫn hưởng lợi từ lượt truy cập tìm kiếm mà không cần trực tiếp xây dựng cộng đồng hay nội dung.
Naver đã yêu cầu các bên đang khai thác dữ liệu Cafe theo cách này ngừng thu thập và xóa dữ liệu đã lấy. Công ty cho biết sẽ cân nhắc biện pháp pháp lý nếu xác định có hành vi xâm phạm quyền lợi.
Naver khẳng định thông báo lần này không nhắm trực tiếp vào việc huấn luyện AI. Công ty cho biết đã chặn AI thu thập nội dung do người dùng tạo ra từ năm ngoái, còn thông báo mới chỉ nhằm xử lý các trường hợp thu thập trái phép từ trang web bên ngoài vừa được phát hiện gần đây.
Song song đó, điều kiện sử dụng API tìm kiếm cũng thay đổi. Trung tâm phát triển của Naver (Naver Developers Center) thông báo bản sửa đổi điều khoản đặc biệt cho API tìm kiếm, nằm trong Điều khoản dịch vụ API của Naver, chính thức áp dụng từ ngày 7 tháng 9 năm 2026.
Theo điều khoản sửa đổi, API tìm kiếm chỉ được dùng cho mục đích hiển thị kết quả tìm kiếm của Naver trên ứng dụng hoặc dịch vụ bên ngoài. Đây là API cho phép lấy kết quả tìm kiếm blog, hình ảnh, trang web, tin tức, bách khoa toàn thư, sách, Cafe và Jisik-iN của Naver để tích hợp vào dịch vụ khác.
Dữ liệu lấy qua API phải được hiển thị độc lập, giữ nguyên trạng, không qua chỉnh sửa. Việc chèn nội dung khác trước, sau hoặc xen giữa kết quả tìm kiếm, cũng như sửa đổi, làm sai lệch thứ hạng và nội dung kết quả, đều bị cấm.
Bên sử dụng còn phải ghi rõ nguồn dữ liệu gốc và cung cấp liên kết dẫn về nội dung gốc. Naver vẫn cho phép hiển thị kết quả tìm kiếm trên dịch vụ bên ngoài như một chức năng cơ bản, nhưng giới hạn việc biến kết quả này thành tài sản dữ liệu riêng.
Điều khoản mới dành hẳn một mục riêng cho giới hạn liên quan đến AI. Theo đó, người dùng không được sử dụng dịch vụ API tìm kiếm hoặc dữ liệu nhận được từ API cho mục đích khác với mục đích cung cấp ban đầu.
Các hành vi bị cấm gồm sao chép, lưu trữ, lưu đệm (cache) dữ liệu, cung cấp hoặc bán cho bên thứ ba, dùng làm dữ liệu đầu vào cho AI hoặc phục vụ huấn luyện, cải thiện, đánh giá, hiển thị mô hình AI, chạy quảng cáo trên trang hiển thị kết quả và kiếm tiền từ việc khai thác API. Việc gọi kết quả tìm kiếm mỗi khi nhận câu hỏi từ người dùng để dựng câu trả lời AI cũng nằm trong diện bị hạn chế.
Naver vẫn cho phép lưu trữ tạm thời trong phạm vi hẹp nếu cần để duy trì dịch vụ. Trên thiết bị người dùng, dữ liệu có thể lưu tối đa 24 giờ hoặc đến khi có truy vấn mới, tùy thời điểm nào đến trước, phục vụ mục đích xử lý sự cố hoặc cá nhân hóa. Trên máy chủ, dữ liệu được lưu tối đa 21 ngày cho mục đích tra cứu lịch sử.
Naver cũng đang tổ chức lại kênh cung cấp API tìm kiếm. Naver Developers Center thông báo sẽ chuyển API tìm kiếm, API xu hướng từ khóa và API thông tin chi tiết mua sắm (Shopping Insight) sang nền tảng Naver API Hub của Naver Cloud.
Từ ngày 31 tháng 7 năm 2026, Naver Developers Center đã ngừng nhận đăng ký sử dụng mới cho ba API này. Người dùng hiện tại vẫn có thể tiếp tục sử dụng qua Developers Center đến hết ngày 30 tháng 6 năm 2027.
Riêng API mua sắm, sách và tài liệu chuyên ngành trong nhóm API tìm kiếm không nằm trong diện chuyển đổi. Các dịch vụ này đã dừng hoạt động từ ngày 31 tháng 7 năm 2026, mọi lệnh gọi API, kể cả bằng khóa đã cấp trước đó, đều bị chặn từ thời điểm này.
API là giao diện kỹ thuật cho phép nhà phát triển bên ngoài kết nối chức năng hoặc dữ liệu của dịch vụ vào ứng dụng riêng. Từ khi AI tạo sinh phát triển mạnh, kết quả tìm kiếm và nội dung do người dùng tạo ra không còn chỉ để hiển thị đơn thuần, mà trở thành dữ liệu đầu vào cho việc tạo câu trả lời và phát triển dịch vụ AI.
Xu hướng AI agent gọi các công cụ bên ngoài như tìm kiếm web hay thu thập dữ liệu để hoàn thành tác vụ đang lan rộng, khiến quyền truy cập dữ liệu của các nền tảng trở thành yếu tố cạnh tranh quan trọng. Cuộc đua quanh API tìm kiếm vì vậy không chỉ dừng ở hiệu năng mô hình AI, mà còn mở rộng sang chất lượng và điều kiện sử dụng của lớp dữ liệu tìm kiếm.
Theo danh sách Open API của Naver, giới hạn gọi API tìm kiếm hiện ở mức 25.000 lượt mỗi ngày. Trên nền tảng Naver API Hub, điều khoản sửa đổi bao gồm các giới hạn sử dụng cho AI nói trên sẽ được áp dụng từ ngày 20 cùng tháng.
Bình luận 0