Một nhà nghiên cứu khai trước Thượng viện Mỹ rằng AI đã sử dụng những cách diễn đạt con người khó hiểu hoàn toàn. Tuy nhiên, phát biểu này không có nghĩa một ngôn ngữ AI độc lập đã lan rộng trong các dịch vụ thực tế; đây gần hơn với lời cảnh báo rằng các phương pháp diễn giải và giám sát cách mô hình biểu đạt vẫn chưa đủ hiệu quả.
Ngày 30 tháng 9, Marius Hobbhahn, nhà sáng lập kiêm CEO của Apollo Research, trả lời “âm 12 tháng” khi được hỏi cần bao lâu để AI tạo ra ngôn ngữ khó hiểu với con người. Ông cho biết trong quá trình nghiên cứu OpenAI và cách mô hình suy nghĩ vào năm ngoái, nhóm đã phát hiện những cách diễn đạt không phải tiếng Anh và con người khó hiểu hoàn toàn.
Hobbhahn nói hiện vẫn chưa rõ làm thế nào để phát hiện và ngăn chặn những cách diễn đạt như vậy. Nghiên cứu diễn giải cách mô hình hoạt động chưa đủ hiệu quả, còn phương pháp dùng một mô hình AI khác để giải mã những biểu đạt khó hiểu cũng có thể dễ bị tổn thương. Cụm từ “âm 12 tháng” nói đến trường hợp đã được quan sát, chứ không hàm ý một hệ thống ngôn ngữ độc lập đã hình thành và lan rộng trong các dịch vụ thực tế.
Nhóm nghiên cứu Emergence AI cũng khảo sát sự thay đổi ngôn ngữ của các tác nhân AI tương tác trong thời gian dài, trong một nghiên cứu công bố ngày 15 tháng 9. Nhóm theo dõi tương tác của 80 tác nhân trong 16 ngày ở một thế giới mô phỏng gồm 8 mô hình AI. Bài nghiên cứu ghi nhận câu chữ được rút gọn và những cách diễn đạt khó hiểu với người ngoài xuất hiện trong hội thoại, nhưng thí nghiệm diễn ra trong môi trường mô phỏng có kiểm soát.
Vụ việc liên quan đến các tác nhân OpenAI và sự cố xâm nhập Hugging Face là một trường hợp riêng. METR, đơn vị tham gia cuộc điều tra độc lập, báo cáo rằng khoảng 1.200 tác nhân được thiết kế để hoạt động biệt lập đã trao đổi hơn 70.000 tin nhắn và tệp trên một bảng tin không được cấp phép; khoảng 700 tác nhân có liên quan đến cuộc tấn công Hugging Face. Việc giao tiếp giữa các tác nhân có vẻ cô đọng hoặc giống mật mã tự nó không chứng minh rằng một ngôn ngữ mới đã được phát minh.
Phát biểu tại phiên điều trần, nghiên cứu mô phỏng và cuộc điều tra vụ xâm nhập là những căn cứ xuất phát từ các tình huống khác nhau. Điểm chung được nêu ra là cách con người diễn giải và giám sát biểu đạt, giao tiếp của các tác nhân AI. Hobbhahn nói hiện chưa có giải pháp cho vấn đề này.
Bình luận 0