Back to top
  • 공유 Chia sẻ
  • 인쇄 In
  • 글자크기 Cỡ chữ
URL đã được sao chép

Anthropic vận hành khoảng 30.000 tác nhân AI, dành 6% năng lực tính toán R&D cho an toàn

Nhà nghiên cứu xem xét nhật ký hoạt động tại phòng kiểm định an toàn AI / TokenPost.ai (macro)

Khoảng 30.000 tác nhân AI đã đồng thời thực hiện các nhiệm vụ nghiên cứu và kỹ thuật trên nền tảng nội bộ của Anthropic. Anthropic cho biết họ giám sát hoạt động của các tác nhân này theo thời gian thực và sau khi hoàn tất, đồng thời phân bổ khoảng 6% năng lực tính toán cho nghiên cứu và phát triển AI trong giai đoạn từ ngày 13 đến 20 tháng 7 năm 2026 cho các công việc an toàn.

Anthropic cho biết số liệu được thống kê trên nền tảng nội bộ được sử dụng nhiều nhất tính đến tháng 8 năm 2026. Quy mô này không đại diện cho toàn bộ hệ thống Anthropic mà là số tác nhân hoạt động tại một thời điểm trên một nền tảng nội bộ cụ thể. Thông tin tương tự cũng được xác nhận trong tài liệu công khai của Anthropic.

Trên nền tảng này, mọi nhiệm vụ của tác nhân đều được kiểm tra bởi hệ thống giám sát trực tuyến trước khi thực thi. Anthropic cho biết sau khi phân tích hơn 1 tỷ quyết định trong tháng 8, hệ thống đã chặn khoảng 0,002%, tương đương khoảng một quyết định trên mỗi 47.000 quyết định.

Giám sát trực tuyến tập trung ngăn chặn những rủi ro xảy ra ngay lập tức hoặc khó đảo ngược. Hệ thống kiểm tra hành vi trước khi tác nhân thực hiện nhiệm vụ và chặn những quyết định có thể gây vấn đề.

Hoạt động giám sát sau đó cũng được tiến hành. Hệ thống đánh dấu khoảng 100.000 bản ghi mỗi tuần và phân loại theo mức độ ưu tiên. Trong số này, khoảng 50 trường hợp có mức ưu tiên cao được con người trực tiếp xem xét.

Giám sát ngoại tuyến phân tích các bản ghi sau khi nhiệm vụ hoàn tất để tìm kiếm những hành vi bất thường chỉ bộc lộ theo thời gian. Việc kết hợp giám sát trực tuyến và ngoại tuyến giúp phân biệt rủi ro trước khi thực thi với các vấn đề được phát hiện sau đó.

Về phân bổ năng lực tính toán, khoảng 6% tổng năng lực tính toán cho nghiên cứu và phát triển AI mà Anthropic đo lường từ ngày 13 đến 20 tháng 7 năm 2026 đã được sử dụng cho các công việc an toàn. Nếu chỉ tính những nhiệm vụ nghiên cứu và phát triển AI do AI dẫn dắt, tỷ lệ năng lực tính toán dành cho an toàn tăng lên khoảng 12%.

Tuy nhiên, Anthropic giải thích rằng chỉ dựa vào năng lực tính toán là chưa đủ để đánh giá toàn diện quy mô nghiên cứu an toàn. Nguyên nhân là nghiên cứu an toàn đôi khi đòi hỏi nhà nghiên cứu dành nhiều thời gian hơn để thiết kế và kiểm chứng thí nghiệm, thay vì huấn luyện các mô hình quy mô lớn.

Anthropic không tính vào năng lực tính toán cho an toàn những công việc đồng thời đóng góp vào cả an toàn và cải thiện hiệu suất. Do đó, Anthropic cho biết số liệu lần này là kết quả thống kê thận trọng về năng lực tính toán được sử dụng cho các công việc an toàn.

Động thái công bố số liệu diễn ra trong bối cảnh AI ngày càng tham gia sâu vào quá trình phát triển AI, nhằm đo lường đồng thời mức độ hoạt động và khả năng giám sát các tác nhân. Anthropic cho biết nếu các công ty phát triển AI hàng đầu khác cũng thường xuyên công bố những chỉ số liên quan và tiến hành xác minh bởi bên thứ ba, dữ liệu này có thể hỗ trợ so sánh tốc độ phát triển AI, năng lực giám sát tác nhân và nguồn lực dành cho an toàn.

<Bản quyền ⓒ TokenPost, nghiêm cấm sao chép và phân phối trái phép>

Phổ biến nhất

Các bài viết liên quan khác

Bình luận 0

Mẹo bình luận

Bài viết tuyệt vời. Mong có bài tiếp theo. Phân tích xuất sắc.

0/1000

Mẹo bình luận

Bài viết tuyệt vời. Mong có bài tiếp theo. Phân tích xuất sắc.
1