Có ý kiến cho rằng 'công tắc ngắt' (kill switch) dùng để buộc dừng hệ thống trí tuệ nhân tạo (AI) có thể không hoạt động hiệu quả trong môi trường AI tự hành được phân tán trên nhiều trung tâm dữ liệu và mạng lưới.
Jacob Coxon, cựu nhà nghiên cứu tại Anthropic, cho biết trong chương trình "Meet the Press" của NBC News ngày 13 (giờ địa phương) rằng công tắc ngắt hiện vẫn có thể hoạt động với các hệ thống AI hiện tại, nhưng việc kiểm soát sẽ trở nên khó khăn hơn khi hệ thống được phân tán trên nhiều trung tâm dữ liệu. Ông cho rằng các công ty AI lớn cần tự giác tuân thủ quy định cho đến khi có một khung pháp lý dài hạn được thiết lập.
Coxon nói: "Hiện nay, nhiều hệ thống AI vẫn có thể kích hoạt công tắc ngắt." Tuy nhiên, ông giải thích rằng nếu trung tâm dữ liệu trải rộng ở nhiều nơi, sẽ cần một số lượng đáng kể công tắc để có thể ngắt toàn bộ hệ thống.
Ông cũng đề cập đến tình huống AI được sao chép sang nhiều hệ thống rồi hoạt động trên toàn bộ internet. Coxon nói: "Nếu một đàn AI bắt đầu tấn công mạng trên phạm vi toàn bộ internet, công tắc ngắt có khả năng sẽ không còn tác dụng."
Phát biểu của Coxon không hẳn là lời kêu gọi trực tiếp bắt buộc áp dụng công tắc ngắt, mà gần với việc đặt ra vấn đề rằng cơ chế quản lý và kiểm soát cần liên tục được điều chỉnh theo tốc độ phát triển công nghệ. Trọng tâm tranh luận cũng mở rộng từ việc có thể tắt một hệ thống đơn lẻ hay không, sang việc liệu có thể thực sự kiểm soát được AI tự hành dạng phân tán hay không.
Quốc hội Mỹ hiện đã có dự luật liên quan. Hạ nghị sĩ Đảng Dân chủ Ted Lieu và Hạ nghị sĩ Đảng Cộng hòa Nathaniel Moran đã đệ trình dự luật "AI Kill Switch Act" vào ngày 23 tháng 7.
Dự luật này yêu cầu các nhà phát triển phải duy trì năng lực kỹ thuật để tạm dừng, giới hạn chức năng, hoặc khi cần thiết là chấm dứt hoạt động của các hệ thống AI nguy hiểm. Dự luật đã được chuyển tới Ủy ban An ninh Nội địa của Hạ viện Mỹ và vẫn chưa được thông qua thành luật.
Trọng tâm của dự luật không phải là một thiết bị tắt toàn bộ AI bằng một nút bấm duy nhất. Thay vào đó, đối với các hệ thống có thể gây ra "thiệt hại thảm khốc", Bộ trưởng An ninh Nội địa có quyền ra lệnh chặn quyền truy cập, giới hạn chức năng cụ thể hoặc chấm dứt hệ thống, và các nhà phát triển phải có phương tiện để đáp ứng các lệnh này.
Một cuộc khảo sát dư luận cũng cho thấy sự ủng hộ đối với các cơ chế kiểm soát. AI Policy Institute cho biết, trong cuộc khảo sát 1.007 cử tri Mỹ được thực hiện từ ngày 10-11 tháng 6, có 86% người được hỏi cho rằng cần có một "công tắc tắt" (off switch) được đảm bảo cho các hệ thống AI mạnh nhất.
AI Policy Institute là một viện nghiên cứu chính sách ủng hộ việc quản lý an toàn AI. Do đó, khi diễn giải kết quả khảo sát này, cần xem xét thêm về cơ cấu mẫu khảo sát và cách đặt câu hỏi.
Đằng sau cuộc tranh luận này còn có những chỉ trích nội bộ về tốc độ phát triển AI. Liên quan đến những chỉ trích nội bộ xoay quanh cuộc đua phát triển AI giữa OpenAI và Anthropic, ngay sau khi từ chức, Coxon đã viết trên X rằng hai công ty này đang chạy đua phát triển siêu trí tuệ có khả năng tự cải thiện, và mô tả đó là hành động "đánh cược mạng sống của chúng ta".
Nhà nghiên cứu an toàn của Anthropic, Evan Hubinger, từng cá nhân đánh giá rằng khả năng AI giết chết toàn bộ loài người vượt quá 10%. Cả hai phát biểu trên đều là ý kiến cá nhân và bài đăng trên mạng xã hội, không phải là xác suất đã được kiểm chứng hay dự báo chính thức của công ty.
Anthropic cũng đang triển khai các nghiên cứu an toàn khác ngoài công tắc ngắt. Lộ trình an toàn của công ty đặt mục tiêu phát triển nguyên mẫu "provable inference" trước ngày 30/9/2026, nhằm xác minh liệu đầu ra của mô hình AI có gắn với một bộ trọng số cụ thể hay không.
"Provable inference" là cách tiếp cận tập trung vào việc theo dõi và xác minh mô hình nào đã tạo ra kết quả nào, thay vì buộc dừng hệ thống. Nếu công tắc ngắt tập trung vào việc dừng hoạt động, thì công nghệ này tập trung vào việc xác minh nguồn gốc đầu ra của mô hình.
Dự luật AI Kill Switch Act hiện vẫn đang ở giai đoạn đề xuất, nên thời điểm thi hành thực tế và đối tượng áp dụng chưa được xác định. Theo lộ trình an toàn của Anthropic, mốc thời gian mục tiêu để phát triển nguyên mẫu "provable inference" là ngày 30 tháng 9.
Bình luận 0