Mô hình AI bảo mật giới hạn Claude Mythos 5 (Claude Mythos 5) của Anthropic (Anthropic) đã kiểm toán giao thức Zcash(ZEC) nhưng không phát hiện thêm lỗi nghiêm trọng nào. Đây là trường hợp thực tế đầu tiên được xác nhận, giữa lúc khoảng cách quyền truy cập mô hình AI bảo mật trong ngành tài sản số đang được chú ý.
Theo Anthropic, công ty đã phát hành rộng rãi Claude Fable 5 (Claude Fable 5) vào ngày 9 tháng 6, trong khi Claude Mythos 5 chỉ được cung cấp giới hạn cho các đối tác của Project Glasswing (Project Glasswing) và một số nhà nghiên cứu. Hai mô hình dùng chung nền tảng, nhưng Mythos 5 không áp dụng một số lớp bảo vệ an ninh mạng như Fable 5.
Anthropic mô tả Mythos 5 là mô hình có năng lực an ninh mạng mạnh nhất thế giới. Người dùng phổ thông chỉ tiếp cận được Fable 5 - phiên bản có cùng năng lực nhưng được bổ sung lớp an toàn chặt hơn.
Các lớp an toàn đôi khi chặn nhầm cả những yêu cầu hợp lệ trong quá trình nghiên cứu bảo mật. Anthropic thừa nhận bộ phân loại an toàn của Fable 5 có thể xảy ra tình trạng nhận diện sai, ngăn cả những yêu cầu có mục đích phòng thủ.
Trong lĩnh vực tài sản số, một lỗi mã nguồn hay sai sót quản lý khóa có thể lập tức dẫn đến việc tài sản bị chuyển đi trên chuỗi. Fireblocks (Fireblocks) cho biết trong báo cáo tháng 2 rằng chỉ cần kẻ tấn công thành công một lần, việc chuyển tài sản trong môi trường tài sản số gần như không thể đảo ngược.
Trong thông báo mở rộng Project Glasswing ngày 2 tháng 6, Anthropic cho biết khoảng 50 đối tác ban đầu đã sử dụng bản xem trước Claude Mythos để phát hiện hơn 10.000 lỗi bảo mật ở mức nghiêm trọng cao hoặc nguy hiểm. Công ty có kế hoạch mở rộng phạm vi tham gia lên khoảng 150 tổ chức, nhưng mỗi tổ chức phải đáp ứng các yêu cầu bảo mật mới được cấp quyền truy cập.
Zooko Wilcox (Zooko Wilcox), người sáng lập Zcash, cho biết trên X ngày 12 tháng 6 rằng theo yêu cầu của Shielded Labs (Shielded Labs), Anthropic đã dùng Mythos để kiểm toán giao thức Zcash và không phát hiện thêm "lỗi nghiêm trọng" nào. Phát biểu này cho thấy giao thức Zcash đã trải qua thêm một vòng kiểm tra bằng mô hình AI bảo mật cấp cao, dù kết quả không đồng nghĩa với việc giao thức đã hoàn toàn an toàn.
Kết quả kiểm toán lần này không đồng nghĩa với việc đảm bảo an toàn tuyệt đối cho giao thức Zcash, cũng không thay thế các đợt kiểm toán bảo mật trước đó. Phạm vi kiểm toán, phiên bản mã nguồn và cách thiết lập prompt chưa được công bố chi tiết.
TokenPost trước đó đã đưa tin về tranh cãi liên quan đến việc xác minh bản nâng cấp Zcash bằng Mythos. Trong quá trình xác minh bảo mật bằng AI, ngoài kết quả mô hình đưa ra, đối tượng được kiểm tra, môi trường vận hành và bước xác minh thủ công của con người cũng cần được xem xét đầy đủ.
OpenAI (OpenAI) cũng áp dụng cách tiếp cận giới hạn quyền truy cập tương tự. Ngày 7 tháng 5, OpenAI công bố cung cấp GPT-5.5 và GPT-5.5-Cyber theo cơ chế "truy cập an ninh mạng đáng tin cậy". GPT-5.5 được dùng cho các tác vụ phòng thủ thông thường, trong khi GPT-5.5-Cyber - phiên bản cho phép nhiều quyền hơn - chỉ hỗ trợ các tác vụ chuyên sâu cho một số đối tác đã qua xác minh.
Theo tài liệu Daybreak (Daybreak) của OpenAI, GPT-5.5-Cyber đạt 85,6% trong đánh giá đơn mô hình CyberGym, 39,5% ở ExploitGym và 69,8% ở SEC-bench Pro. Khi AI agent tiếp cận hạ tầng thực tế, cách thiết lập quyền trong môi trường đánh giá ảnh hưởng trực tiếp đến kết quả.
Binance (Binance) cho biết trên trang bằng chứng dự trữ rằng sàn nắm giữ tài sản người dùng theo tỷ lệ 1:1. Tuy nhiên, bằng chứng dự trữ chỉ thể hiện số dư ví và việc có bao gồm nợ phải trả hay không, đây là chỉ số bảo mật hoàn toàn khác với quyền sử dụng các mô hình AI bảo mật hiệu năng cao.
Việc cung cấp giới hạn các mô hình AI bảo mật hiệu năng cao phản ánh nỗ lực mở rộng năng lực cho các tổ chức đã được xác minh, đồng thời kiểm soát rủi ro bị lạm dụng. Anthropic dự kiến mở rộng phạm vi tham gia Project Glasswing lên khoảng 150 tổ chức, nhưng chỉ những tổ chức đáp ứng đủ yêu cầu bảo mật mới được cấp quyền truy cập.
Bình luận 0