Anthropic và OpenAI đang tăng cường sử dụng mô hình trí tuệ nhân tạo (AI) trong nghiên cứu và phát triển, nhưng chưa có bằng chứng cho thấy hai công ty đã đạt đến giai đoạn tự cải thiện đệ quy (RSI), trong đó AI tự thiết kế và phát triển mô hình tiếp theo mà không có sự giám sát của con người.
Crypto Briefing phân tích ngày 22, dựa trên các bài đăng mạng xã hội và dữ liệu thị trường công khai, rằng Anthropic và OpenAI đang tiến gần RSI khi tìm cách làm cho mô hình AI nhỏ hơn, thông minh hơn và rẻ hơn. Tuy nhiên, phân tích này không khẳng định hai công ty đã đạt RSI.
RSI không chỉ đề cập đến việc AI cải thiện hiệu suất của chính mình, mà còn bao gồm việc thực hiện quá trình thiết kế và phát triển các mô hình thế hệ tiếp theo. Hiện nay, con người đặt mục tiêu nghiên cứu và tiêu chí đánh giá, còn AI viết mã và tiến hành thí nghiệm. Giai đoạn này có một số yếu tố của RSI nhưng vẫn khác với phát triển hoàn toàn tự chủ.
Anthropic cho biết trong bản phân tích chính thức rằng “chúng tôi chưa đạt đến giai đoạn đó và tự cải thiện đệ quy cũng không phải điều tất yếu”. Công ty đồng thời để ngỏ khả năng AI có thể tiến gần RSI nhanh hơn dự kiến khi mức độ tham gia vào quá trình phát triển của chính nó tăng lên.
Anthropic cho biết hơn 80% mã được hợp nhất vào kho mã của công ty tính đến tháng 5/2026 do Claude viết. Tuy nhiên, công ty lưu ý rằng chỉ số dòng mã không đủ để đánh giá đầy đủ chất lượng hoặc mức tăng năng suất thực tế.
Anthropic cũng cho biết trong quý II/2026, số lượng mã được mỗi kỹ sư hợp nhất mỗi ngày đã cao gấp 8 lần so với năm 2024. Con số này cho thấy mức độ sử dụng AI trong viết và hợp nhất mã đã tăng, nhưng không có nghĩa AI tự quyết định hướng nghiên cứu.
Phạm vi công việc AI thực hiện trong nghiên cứu cũng đang mở rộng. Anthropic đã công bố trường hợp một tác nhân dựa trên Claude tự hình thành giả thuyết và thiết kế thí nghiệm cho một đề tài nghiên cứu mở liên quan đến an toàn AI.
Trong trường hợp này, con người xác định chủ đề nghiên cứu và tiêu chí đánh giá. Tác nhân phụ trách thiết kế chi tiết và lặp lại thí nghiệm, nhưng việc lựa chọn nội dung nghiên cứu và tiêu chuẩn đánh giá kết quả vẫn nằm dưới sự kiểm soát của con người.
OpenAI cho biết trong một bài viết chính thức vào tháng 9 rằng công ty đã đạt mục tiêu xây dựng “thực tập sinh nghiên cứu tự động” có thể thực hiện các nhiệm vụ nghiên cứu kéo dài vài ngày dưới sự chỉ dẫn của con người. Tài liệu về tăng tốc nghiên cứu do OpenAI công bố giải thích rằng giai đoạn này vẫn dựa trên việc con người đặt mục tiêu và giám sát.
OpenAI cho biết về dài hạn, công ty sẽ xây dựng các nhà nghiên cứu tự động có thể thúc đẩy nghiên cứu học sâu và nghiên cứu căn chỉnh dưới sự giám sát của con người. Đồng thời, công ty nhấn mạnh RSI hoàn toàn tự chủ chưa xảy ra và việc duy trì quyền kiểm soát của con người là điều kiện quan trọng.
Trong cuộc cạnh tranh mô hình AI gần đây, mức độ tự động hóa quy trình phát triển mô hình đang được chú trọng bên cạnh hiệu suất. Khi Anthropic và OpenAI đưa AI vào viết mã, thiết kế thí nghiệm và đánh giá kết quả, vai trò của nhà nghiên cứu đang chuyển từ trực tiếp thực hiện sang đặt mục tiêu và kiểm chứng.
Tuy nhiên, tốc độ nghiên cứu và mức độ tự chủ không đồng nghĩa với nhau. AI càng tham gia nhiều vào phát triển mô hình thế hệ tiếp theo, thí nghiệm có thể càng nhanh, nhưng đồng thời xuất hiện lo ngại rằng con người sẽ khó hiểu đầy đủ cách mô hình vận hành và hướng cải thiện của mô hình.
OpenAI đang xem nghiên cứu an toàn liên quan đến RSI và hệ thống giám sát tự động là những nhiệm vụ riêng biệt. Anthropic cũng cho biết cần xem xét nguy cơ mất kiểm soát của con người khi năng lực AI tăng lên.
Cuộc thảo luận này cho thấy tự động hóa nghiên cứu và phát triển AI đang tiến triển nhanh hơn là khẳng định Anthropic và OpenAI đã giải quyết được RSI. Để đánh giá liệu RSI đã đạt được hay chưa, hai công ty cần công bố kết quả cụ thể cho thấy mô hình thế hệ tiếp theo được thiết kế, huấn luyện và đánh giá mà không có sự can thiệp của con người.
Bình luận 0