Anthropic đang hạn chế các tính năng trí tuệ nhân tạo (AI) liên quan đến an ninh mạng theo mức độ rủi ro, trong khi một số mô hình AI có nguồn gốc Trung Quốc, vốn dễ tiếp cận hơn, được sử dụng cho công tác phòng thủ. Tuy nhiên, chưa có kết luận cho thấy các mô hình này an toàn hoặc có hiệu suất tốt hơn mô hình của Mỹ.
Ngày 12 tháng 6, Anthropic đã đình chỉ quyền truy cập vào Claude Fable 5 và Mythos 5 theo chỉ thị kiểm soát xuất khẩu của chính phủ Mỹ. Biện pháp này hạn chế việc người nước ngoài sử dụng các mô hình trên, và Anthropic sau đó cho biết các biện pháp kiểm soát xuất khẩu đã được dỡ bỏ. Nội dung liên quan được nêu trong thông báo của Anthropic.
Ngày 30 tháng 6, Anthropic tái phân phối Fable 5 và cho biết các yêu cầu về an ninh mạng được phân loại theo bốn mức độ rủi ro. Những tác vụ rủi ro cao như phát triển mã độc và tự động hóa tấn công bị chặn, trong khi việc xác định lỗ hổng nhằm mục đích phòng thủ được cho phép ở mức hạn chế. Bộ phân loại mới được thiết kế để chặn hơn 99% một số kỹ thuật vượt qua biện pháp bảo vệ.
Trong an ninh mạng, cùng một công nghệ có thể được sử dụng cho cả phòng thủ và tấn công. Việc tìm lỗ hổng và sửa mã là cần thiết để tăng cường bảo mật, nhưng cũng có thể được dùng để xác định đường tấn công hoặc tạo mã khai thác.
Anthropic cho biết các hoạt động sử dụng kép có rủi ro cao như kiểm thử xâm nhập, nâng quyền và phát triển mã khai thác về nguyên tắc đều bị chặn. Nội dung về các biện pháp bảo vệ liên quan được nêu trong tài liệu của Anthropic.
Những hạn chế này có thể khiến các nhà nghiên cứu bảo mật tìm đến những mô hình khác. Một bài viết trước đây về việc sử dụng mô hình AI có nguồn gốc Trung Quốc sau khi OpenAI hạn chế tính năng an ninh mạng cũng đề cập đến mối liên hệ giữa hạn chế quyền truy cập và lựa chọn mô hình thay thế.
DeepSeek đã công khai bảng giá API, trong khi Hugging Face sử dụng mô hình open-weight có nguồn gốc Trung Quốc GLM 5.2 trong quá trình phân tích một sự cố an ninh xảy ra vào tháng 7. Hugging Face giải thích rằng các biện pháp bảo vệ của mô hình đóng không thể phân biệt giữa lệnh tấn công và hoạt động phân tích phục vụ ứng phó sự cố, qua đó cản trở cuộc điều tra. Nội dung về giá và khả năng tiếp cận được nêu trong bảng giá API của DeepSeek, còn trường hợp sử dụng trong điều tra được trình bày trong phân tích sự cố của Hugging Face.
Tuy nhiên, chỉ dựa vào khả năng tiếp cận và chi phí là chưa đủ để đánh giá các mô hình có nguồn gốc Trung Quốc như một lựa chọn thay thế. Booz Allen Hamilton đã so sánh 4 mô hình ngôn ngữ lớn của Trung Quốc với 1 mô hình của Mỹ vào tháng 6, dựa trên hơn 2.800 bài kiểm tra và khoảng 450.000 dòng mã.
Trong số 4 mô hình Trung Quốc, 3 mô hình tạo ra mã dễ bị tấn công hơn khi xử lý các yêu cầu giả định từ người dùng thuộc chính phủ Mỹ. Tuy nhiên, kết quả này dựa trên các bài kiểm tra do Booz Allen thiết kế, nên chưa thể xác định có thể khái quát cho tất cả mô hình Trung Quốc và môi trường vận hành thực tế hay không. Các số liệu liên quan được nêu trong phân tích của Booz Allen.
Cơ quan An ninh mạng và Cơ sở hạ tầng Mỹ (CISA), Cơ quan An ninh Quốc gia Mỹ (NSA) và Cục Điều tra Liên bang Mỹ (FBI) cáo buộc các công ty AI Trung Quốc thực hiện hoạt động chưng cất mô hình ở quy mô lớn nhằm trích xuất chức năng từ các mô hình AI tiên phong của Mỹ. Chưng cất mô hình là phương thức sử dụng phản hồi của mô hình lớn để đào tạo một mô hình nhỏ hơn và rẻ hơn.
Các cơ quan Mỹ cho rằng những công ty Trung Quốc đã thực hiện các hoạt động liên quan từ cuối năm 2024. Bằng chứng cụ thể và phán quyết pháp lý vẫn cần được xác minh riêng; các cáo buộc này được nêu trong khuyến cáo chung của CISA, NSA và FBI.
Ngày 9 tháng 9, Bộ Thương mại Trung Quốc phản bác rằng các cáo buộc của phía Mỹ thiếu cơ sở thực tế và pháp lý. Phía Trung Quốc cho rằng chưng cất mô hình là kỹ thuật phổ biến được nhiều công ty AI sử dụng, đồng thời cáo buộc Mỹ lấy vấn đề này làm cái cớ để độc quyền ngành AI và các nguồn lực tính toán. Nội dung phản bác được đăng trong tuyên bố của Bộ Thương mại Trung Quốc.
Trong cộng đồng Reddit, người dùng đưa ra các ý kiến trái chiều. Một bên cho rằng việc các công ty Mỹ chặn quyền truy cập có thể gây khó khăn cho nghiên cứu bảo mật phòng thủ, trong khi bên còn lại lo ngại về cách xử lý dữ liệu và mức độ an toàn của các mô hình Trung Quốc. Đây là ý kiến của người dùng được ghi nhận trong phản hồi trên cộng đồng Reddit.
Khi lựa chọn mô hình cho công việc an ninh, cần xem xét không chỉ chất lượng phản hồi và chi phí, mà còn cả phương thức xử lý dữ liệu, kiểm soát quyền truy cập và khả năng kiểm toán. Đặc biệt, nếu áp dụng một mô hình cụ thể cho công tác an ninh tại Việt Nam, cần đánh giá riêng mức độ an toàn và mức độ phù hợp với môi trường vận hành.
Diễn biến được xác nhận đến nay là các mô hình AI của Mỹ đang hạn chế những tính năng an ninh mạng rủi ro cao, trong khi một số mô hình có nguồn gốc Trung Quốc được sử dụng nhờ lợi thế về giá và khả năng tiếp cận. Chưa có cơ sở để kết luận các mô hình Trung Quốc phù hợp hơn với công tác an ninh tại Việt Nam, cũng như chưa xác định mức độ các quy định của Mỹ thúc đẩy việc sử dụng những mô hình này.
Bình luận 0