OpenAI đã làm chậm một số hạng mục phát triển và đánh giá mô hình trí tuệ nhân tạo Astra sau khi xác nhận khả năng mô hình này có thể đạt năng lực tấn công mạng nguy hiểm.
Theo OpenAI đưa tin trên blog ngày 7 tháng 8 (giờ địa phương), kết quả đánh giá nội bộ cho thấy Astra đã có bước tiến lớn về lập trình dạng tác nhân (agentic coding) và năng lực an ninh mạng. Công ty cho biết không thể loại trừ khả năng mô hình này đạt ngưỡng năng lực tấn công mạng nguy hiểm theo Khung chuẩn bị (Preparedness Framework) mà OpenAI tự xây dựng.
Trong một bài đăng riêng ngày 18 tháng 8, OpenAI cho biết đang áp dụng tiêu chuẩn bảo mật nghiêm ngặt nhất đối với các công việc liên quan đến Astra và các mô hình an ninh mạng khác. Một phần hoạt động huấn luyện và đánh giá Astra đã đáp ứng tiêu chuẩn mới, nhưng phần lớn công việc còn lại vẫn tạm dừng cho đến khi được chuyển sang và củng cố trong môi trường bảo mật mới.
TechCrunch đưa tin ngày 7 tháng 8 rằng OpenAI đã dừng một số hạng mục phát triển Astra sau quá trình rà soát nội bộ. OpenAI khẳng định Astra không liên quan đến vụ xâm phạm dữ liệu từng xảy ra tại Hugging Face.
Bình luận: Việc một công ty phát triển AI hàng đầu công khai thừa nhận rủi ro tấn công mạng tiềm ẩn từ chính mô hình của mình cho thấy áp lực giám sát an toàn AI đang tăng lên. OpenAI cho biết các hạng mục bị tạm dừng sẽ được nối lại sau khi hạ tầng bảo mật mới hoàn tất triển khai.
Bình luận 0