Anthropic đã chặn một trường hợp cố gắng sử dụng AI vào nghiên cứu có thể dẫn tới phát triển vũ khí sinh học, nhưng theo báo cáo, nhóm nghiên cứu chỉ trong vài ngày đã chuyển sang dùng mô hình AI của đối thủ. Vụ việc cho thấy việc kiểm soát các cơ chế an toàn của AI tạo sinh (generative AI) khó có thể chỉ dựa vào việc một công ty đơn lẻ ngăn chặn.
Anthropic cho biết trong báo cáo tình báo về mối đe dọa (threat intelligence report) công bố ngày 10 rằng công ty đã xác định và chặn 5 trường hợp sử dụng Claude liên quan đến nghiên cứu sinh học. Theo bài viết của AP (Associated Press), một đơn xin tài trợ nghiên cứu đã đề cập đến nghiên cứu “gain-of-function” nhằm tăng khả năng lây truyền và né tránh miễn dịch của virus chikungunya.
Theo BeInCrypto đưa tin, sau khi Anthropic ngừng hỗ trợ Claude cho nhóm nghiên cứu này, họ đã chuyển sang sử dụng một mô hình AI cạnh tranh chỉ trong vòng vài ngày. Anthropic cho biết công ty đã tăng cường các biện pháp bảo vệ trên các mô hình mới nhất nhằm hạn chế những truy vấn liên quan đến nghiên cứu sinh học có tính lưỡng dụng (dual-use).
Bình luận: Vụ việc này cho thấy một thách thức lớn trong quản trị an toàn AI — dù một công ty chủ động cảnh báo và chặn hành vi lạm dụng, nếu các nền tảng khác chưa có cơ chế giám sát tương đương, những người dùng có ý đồ rủi ro vẫn có thể dễ dàng chuyển sang nơi khác. Khi các mô hình AI tạo sinh ngày càng phổ biến, việc xây dựng cơ chế phối hợp giám sát xuyên công ty, xuyên ngành nhiều khả năng sẽ trở thành bài toán cấp thiết mà ngành công nghiệp này phải đối mặt trong thời gian tới.
Bình luận 0