Back to top
  • 공유 Chia sẻ
  • 인쇄 In
  • 글자크기 Cỡ chữ
URL đã được sao chép

80% mã nguồn sản xuất do Claude viết, chi phí kiểm soát cũng tăng theo

Cảnh rà soát mã trên màn hình laptop / TokenPost.ai

Tính đến tháng 5 năm 2026, hơn 80% mã nguồn sản xuất được hợp nhất (merge) vào hệ thống nội bộ của Anthropic là do Claude viết. Giới quan sát nhận định AI không còn là công cụ hỗ trợ lập trình đơn thuần mà đã trở thành trụ cột trong quy trình viết mã cho dịch vụ thực tế.

Anthropic công bố số liệu này trong bài nghiên cứu có tựa đề "When AI builds itself". Công ty lưu ý rằng con số 80% không phản ánh toàn bộ lượng mã được tạo ra, mà chỉ tính tỷ lệ mã do Claude viết trong số mã đã được hợp nhất vào sản phẩm chính thức. Anthropic cũng thừa nhận quy trình quy gán (attribution) còn có kẽ hở, khiến một phần mã do AI tự động tạo ra có thể chưa được thống kê đầy đủ.

Cũng trong bài viết này, Anthropic cho biết lượng mã được mỗi kỹ sư hợp nhất trong quý II năm 2026 đã tăng gấp 8 lần so với mức trung bình giai đoạn 2021-2025. Với các tác vụ có độ mở cao nhất, tỷ lệ hoàn thành thành công của Claude đạt 76% vào tháng 5 năm 2026, tăng 50 điểm phần trăm so với 6 tháng trước đó.

Anthropic liên hệ xu hướng này với khả năng "tự cải thiện đệ quy" (recursive self-improvement). Công ty giải thích rằng khi AI đảm nhận một phần công việc viết mã, chạy thử nghiệm và rà soát phục vụ cho việc phát triển chính AI, tốc độ phát triển đã được đẩy nhanh hơn.

Tuy nhiên, Anthropic khẳng định chưa đạt đến giai đoạn đó. Con người vẫn là bên đặt ra mục tiêu, quyết định hướng đi và đưa ra phê duyệt cuối cùng.

Tự cải thiện đệ quy là khái niệm chỉ việc AI trực tiếp tham gia vào quá trình phát triển thế hệ AI tiếp theo, giúp đẩy nhanh tốc độ cải thiện hiệu năng. Trước đây, quy trình phát triển phần mềm thường do con người đặt yêu cầu, viết mã, rồi kiểm thử và rà soát trước khi triển khai. Nhưng khi các công cụ lập trình AI ngày càng phổ biến, phạm vi tự động hóa trong khâu viết và rà soát mã cũng mở rộng theo.

Vấn đề là chi phí kiểm soát cũng tăng theo tốc độ phát triển. Trong bài viết về bảo mật vòng đời phát triển phần mềm công bố ngày 21 tháng 7, Anthropic một lần nữa xác nhận Claude viết khoảng 80% mã được hợp nhất, đồng thời cho biết cách thức rà soát bảo mật và quản lý quyền truy cập cũng cần thay đổi theo.

Công ty đề xuất chia codebase theo mức độ rủi ro, triển khai nhiều AI đóng vai trò rà soát, đồng thời giữ lại bước phê duyệt của con người ở những phần rủi ro cao. Các biện pháp khác được đưa ra gồm sandbox, máy ảo, kiểm soát giao tiếp ra bên ngoài và thiết lập ranh giới quyền truy cập.

Chỉ riêng quy trình phê duyệt cũng chưa đủ. Trong bài viết ngày 25 tháng 5, Anthropic cho biết tỷ lệ người dùng Claude Code chấp thuận các lời nhắc phê duyệt (approval prompt) vào khoảng 93%. Công ty lo ngại việc yêu cầu phê duyệt lặp đi lặp lại có thể khiến người dùng trở nên kém cảnh giác hơn, hiện tượng được gọi là "mệt mỏi vì phê duyệt" (approval fatigue).

Điểm nghẽn trong khâu rà soát cũng thể hiện qua số liệu. Trong tài liệu giới thiệu hệ thống rà soát mã công bố ngày 9 tháng 3, Anthropic cho biết gần như toàn bộ các yêu cầu hợp nhất (pull request - PR) nội bộ đều được đưa vào rà soát mã. Tỷ lệ PR nhận được bình luận rà soát thực chất đã tăng từ 16% lên 54%, nhưng quyết định phê duyệt cuối cùng vẫn thuộc về con người.

Giới công nghệ có cái nhìn trái chiều về xu hướng này. Một bên xem công cụ lập trình AI là minh chứng cho việc năng suất phát triển được nâng cao. Bên còn lại cho rằng vấn đề lớn hơn nằm ở việc truy vết nguồn gốc, kiểm chứng và xác định trách nhiệm, chứ không chỉ đơn thuần là ai viết mã.

Trong khảo sát công bố ngày 23 tháng 6, GitLab(GTLB) cho biết 80% người được hỏi thừa nhận tốc độ áp dụng công cụ AI của tổ chức họ đã vượt qua tốc độ xây dựng chính sách quản lý. Tỷ lệ người trả lời cho rằng tổ chức đang gặp thách thức trong quản trị mã do AI tạo ra là 92%.

Câu chuyện này không phải chuyện xa lạ với các doanh nghiệp crypto. Dịch vụ on-chain và hạ tầng giao dịch đòi hỏi tốc độ triển khai và kiểm chứng bảo mật phải song hành. TokenPost trước đó từng đưa tin về trường hợp các AI agent của Anthropic can thiệp lẫn nhau khi cùng thao tác trên một kho lưu trữ trong một thử nghiệm nội bộ.

Khi các công cụ phát triển AI mở rộng phạm vi sang mã nguồn dịch vụ thực tế và cả quyền vận hành, hệ thống kiểm chứng sẽ là thứ bị thử thách trước tiên, chứ không phải năng suất. Ở những lĩnh vực có chi phí sửa lỗi sau triển khai rất cao như hợp đồng thông minh (smart contract), hạ tầng giao dịch hay dịch vụ ví, việc lưu lại hồ sơ rà soát và trách nhiệm phê duyệt có thể trở nên quan trọng hơn cả việc xác định ai là người viết mã.

Cần lưu ý các số liệu trên do chính Anthropic tự công bố, chưa qua kiểm toán độc lập từ bên ngoài. Chỉ số tăng gấp 8 lần cũng được tính dựa trên số dòng mã, nên chưa phản ánh đầy đủ chất lượng, độ phức tạp hay khả năng bảo trì của mã nguồn. Tỷ lệ mã do Claude viết đã tăng lên rõ rệt, nhưng việc mã nào được triển khai và ai chịu trách nhiệm vẫn cần con người xác nhận.

<Bản quyền ⓒ TokenPost, nghiêm cấm sao chép và phân phối trái phép>

Phổ biến nhất

Các bài viết liên quan khác

Bình luận 0

Mẹo bình luận

Bài viết tuyệt vời. Mong có bài tiếp theo. Phân tích xuất sắc.

0/1000

Mẹo bình luận

Bài viết tuyệt vời. Mong có bài tiếp theo. Phân tích xuất sắc.
1