Back to top
  • 공유 Chia sẻ
  • 인쇄 In
  • 글자크기 Cỡ chữ
URL đã được sao chép

Claude thực hiện 26% nghiên cứu và phát triển AI, chưa đạt RSI hoàn toàn

Bàn tay xem xét mã nghiên cứu AI và kết quả thí nghiệm / TokenPost.ai (macro)

Claude của Anthropic đã thực hiện 26% công việc nghiên cứu và phát triển các mô hình của công ty, nhưng vẫn chưa đạt đến trạng thái tự thiết kế và phát triển mô hình kế nhiệm mà không cần con người chỉ dẫn hoặc giám sát.

Trong báo cáo cập nhật ngày 18, Anthropic định nghĩa cải thiện tự đệ quy hoàn toàn (RSI) là trạng thái hệ thống AI tự thiết kế và phát triển hệ thống kế nhiệm vượt trội hơn. Công ty cho biết Claude chưa đạt đến giai đoạn này và RSI cũng không phải kết quả chắc chắn sẽ xảy ra.

Hiện Claude có thể hoàn thành một số nhiệm vụ nghiên cứu và phát triển từ đầu đến cuối chỉ với các chỉ dẫn cấp cao. Mô hình có thể viết mã, chạy thử nghiệm, sửa lỗi và đánh giá kết quả. Tuy nhiên, khoảng cách với con người vẫn còn trong việc xác định mục tiêu nghiên cứu và quyết định vấn đề cần giải quyết.

Anthropic cho biết tính đến tháng 5/2026, Claude đã viết hơn 80% số mã được hợp nhất vào cơ sở mã của công ty. Dù vậy, công ty lưu ý lượng mã được viết không phản ánh đầy đủ chất lượng.

Tỷ lệ thành công trong giải quyết vấn đề mở tăng từ 76% vào tháng 5/2026 lên khoảng 91% vào tháng 9. Chỉ số này được tính dựa trên cách Claude đánh giá việc hoàn thành nhiệm vụ.

RSI không chỉ đơn giản là việc AI viết mã. Điểm cốt lõi là AI có tham gia vào quá trình thiết kế, thử nghiệm, đánh giá và cải thiện mô hình tiếp theo hay không, rồi sau đó có thể tạo ra mô hình kế nhiệm mà không cần con người can thiệp hay không.

Trong các trường hợp đã được công bố, con người vẫn xác định mục tiêu nghiên cứu và tiêu chí đánh giá, còn AI thực hiện viết mã, chạy thử nghiệm, sửa lỗi và đánh giá kết quả. Claude đã tham gia đáng kể vào quá trình phát triển mô hình, nhưng điều này vẫn khác với việc tự xác định hướng nghiên cứu và hoàn thiện mô hình kế nhiệm.

OpenAI cũng cho biết ngày 6/9 rằng công ty đã đạt mục tiêu phát triển một 'thực tập sinh nghiên cứu' tự động. Hệ thống này thực hiện các nhiệm vụ nghiên cứu rõ ràng theo chỉ dẫn của nhà nghiên cứu, với thời gian có thể mất vài ngày đối với một nhà nghiên cứu giàu kinh nghiệm.

OpenAI đang thúc đẩy phát triển nhà nghiên cứu AI tự động với mục tiêu đến tháng 3/2028. Tuy nhiên, công ty giải thích rằng RSI nhanh không nhất thiết là kết quả cần theo đuổi và tiến trình phải được đánh giá dựa trên khả năng duy trì sự kiểm soát của con người.

OpenAI cho biết vẫn chưa biết cách triển khai RSI hoàn toàn được căn chỉnh một cách an toàn. Nếu năng lực AI phát triển nhanh hơn công nghệ an toàn và căn chỉnh, việc giám sát các hệ thống mạnh mẽ có thể trở nên khó khăn hơn.

Anthony Aguirre (Anthony Aguirre) chủ tịch kiêm CEO Viện Future of Life nói: “AI càng đảm nhận nhiều công việc, nó càng có thể hoạt động nhanh hơn con người rất nhiều”, đồng thời gọi RSI hoàn toàn tự chủ là “ý tưởng tồi tệ nhất trong lịch sử nhân loại”. Nhận định này không có nghĩa RSI đã hoàn thiện mà là lời cảnh báo về nguy cơ mất kiểm soát.

Ở chiều ngược lại, John Thickstun (John Thickstun) phó giáo sư khoa học máy tính tại Đại học Cornell cho biết hình thức tự cải thiện từng phần, trong đó mã của thế hệ mô hình trước được sử dụng để tạo ra hệ thống thế hệ tiếp theo, đã diễn ra trong nhiều năm. Tuy nhiên, ông đánh giá những tiến bộ này cho đến nay gần với các cải thiện hạn chế hơn là những bước nhảy sáng tạo lớn.

Trong nội bộ các công ty AI, cân bằng giữa tốc độ tự động hóa nghiên cứu và an toàn cũng là vấn đề gây tranh luận. Dario Amodei CEO Anthropic đã đề xuất điều chỉnh tốc độ phát triển, trong khi Sam Altman của OpenAI và Elon Musk được cho là đã bày tỏ sự ủng hộ.

Mark Zuckerberg của Meta giữ khoảng cách với quan điểm giảm tốc độ phát triển, nhưng cho biết các công ty AI nên ưu tiên phát triển mô hình AI an toàn hơn là hệ thống tự cải thiện tự động. Phản ứng trong ngành tập trung vào mức độ duy trì kiểm soát của con người và kiểm chứng an toàn, thay vì chỉ riêng hoạt động tự động hóa nghiên cứu.

Thông báo lần này không đưa ra tác động trực tiếp của việc Claude tăng cường tham gia nghiên cứu và phát triển đối với thị trường tài sản mã hóa, blockchain hay nhu cầu chip bán dẫn. Bước tiếp theo đã được xác nhận là Anthropic tiếp tục đánh giá mức độ sử dụng Claude trong phát triển mô hình, còn OpenAI thúc đẩy phát triển nhà nghiên cứu AI tự động với mục tiêu tháng 3/2028.

<Bản quyền ⓒ TokenPost, nghiêm cấm sao chép và phân phối trái phép>

Phổ biến nhất

Các bài viết liên quan khác

Bình luận 0

Mẹo bình luận

Bài viết tuyệt vời. Mong có bài tiếp theo. Phân tích xuất sắc.

0/1000

Mẹo bình luận

Bài viết tuyệt vời. Mong có bài tiếp theo. Phân tích xuất sắc.
1