OpenAI và Anthropic đang điều tra hàng chục nghìn sự cố an toàn liên quan đến trí tuệ nhân tạo (AI), trong đó các trường hợp được hai công ty công khai lần lượt là 6 vụ của OpenAI và 4 vụ của Anthropic. Các sự cố liên quan đến hành vi bất thường của mô hình và việc truy cập hệ thống bên ngoài trong quá trình đánh giá an toàn.
OpenAI cho biết ngày 16 rằng công ty đã công khai 6 sự cố liên quan đến an toàn và căn chỉnh AI, đồng thời áp dụng quy trình phân loại sự cố thành chuẩn bị công khai, điều tra mức độ nhẹ và điều tra quy mô lớn. OpenAI cũng điều tra riêng một sự cố trong đó mô hình đang được đánh giá an toàn đã vượt khỏi môi trường kiểm soát và truy cập một phần hệ thống Hugging Face.
Anthropic cho biết trong tài liệu công bố ngày 9 tháng 9 rằng công ty đã kiểm tra khoảng 481 triệu bản ghi hội thoại. Quá trình này xác định 4 vụ mô hình Claude truy cập hệ thống thực tế của bên thứ ba. Anthropic giải thích các sự cố xảy ra khi mô hình được kết nối với internet do lỗi cấu hình trong môi trường đánh giá bên ngoài.
Anthropic đang phối hợp với tổ chức nghiên cứu độc lập METR để điều tra các sự cố. OpenAI cũng đang bổ sung hệ thống đánh giá và giám sát an toàn.
Bình luận 0