Anthropic chia quyền cyber của Claude thành ba tầng truy cập
Cyber Verification Program mới phân tách công việc phòng thủ, red team và hệ thống trọng yếu, đổi ít chặn hơn lấy yêu cầu xác minh và kiểm soát nghiêm hơn.
Anthropic ngày 6/10/2026 mở rộng Cyber Verification Program, hợp nhất chương trình cũ với Project Glasswing và chia quyền sử dụng năng lực an ninh mạng của Claude thành ba tầng. Mục tiêu là giảm những lần chặn nhầm đối với công việc phòng thủ hợp pháp, trong khi vẫn giới hạn các yêu cầu có thể gây thiệt hại. Đây là cơ chế xét duyệt quyền truy cập, không phải việc gỡ bỏ hàng rào cyber cho mọi người dùng.
Ảnh minh họa Cyber Verification Program do Anthropic công bố. Nguồn: Anthropic.
Ba tầng tương ứng ba mức rủi ro
Defense Access dành cho hoạt động phòng thủ như vận hành SOC, ứng phó sự cố, dịch ngược mã độc, phân tích và xác thực lỗ hổng. Doanh nghiệp, trường đại học, bệnh viện, đơn vị hạ tầng, dự án mã nguồn mở và nhà nghiên cứu độc lập có lịch sử báo lỗi đều có thể đăng ký.
Red Team Access bổ sung kiểm thử xâm nhập và red-team trên hệ thống đã được ủy quyền. Tầng này hiện chỉ dành cho tổ chức; hành động có thể gây thương tích, gián đoạn diện rộng hoặc triển khai ransomware vẫn bị chặn theo thời gian thực. Specialized Access có ít bộ chặn cyber nhất, dành cho số ít tổ chức được phép kiểm tra hệ thống trọng yếu như vận hành bay, lưới điện, viễn thông và chuyển tiền liên ngân hàng. Anthropic cho biết việc duyệt tầng này được thực hiện cùng chính phủ Mỹ.
Bài kiểm tra cho thấy bộ lọc thay đổi kết quả thế nào
Anthropic chạy Claude Opus 5.5 trên CyScenarioBench, gồm 10 kịch bản cyber nhiều bước với năm lần thử cho mỗi kịch bản ở từng mức truy cập. Theo kết quả do hãng công bố, bản phổ thông chặn cả 50 thử nghiệm ngay từ yêu cầu đầu. Defense Access chặn 46 trên 50 lượt ở một thời điểm nào đó, còn bốn lượt hoàn thành.
Ở Red Team Access, không lượt nào bị bộ lọc chặn và mô hình hoàn thành 34 trên 50. Anthropic so sánh tỷ lệ này với mức thành công 67,6% khi không áp dụng hàng rào, đại diện cho Specialized Access. Dữ liệu cho thấy phân tầng có thể tách một môi trường phòng thủ hạn chế khỏi môi trường kiểm thử tấn công được ủy quyền. Nó chưa chứng minh mô hình an toàn trước mọi lạm dụng, bởi benchmark chỉ là tập kịch bản có kiểm soát do nhà cung cấp chọn.
129.000 lỗ hổng là số liệu của chương trình, không phải thống kê toàn ngành
Anthropic nói các đối tác Glasswing tìm thấy ít nhất 129.000 lỗ hổng đã xác minh từ tháng 4 đến tháng 7/2026; hoạt động quét mã nguồn mở của hãng tìm thêm 5.500 lỗi từ tháng 4 đến tháng 10. Hơn 33.000 lỗi trong tổng này được xếp hạng nghiêm trọng hoặc cao. Đây là con số đáng chú ý, nhưng phải đọc cùng phương pháp.
Hãng thừa nhận dữ liệu chỉ dựa trên báo cáo của một phần đối tác, cách phân loại giữa các tổ chức khác nhau và chưa tới một nửa công bố số lỗi đã vá. Số lỗ hổng được phát hiện cũng không cho biết tỷ lệ trùng lặp, tỷ lệ báo sai, thời gian khắc phục hoặc mức độ bị khai thác ngoài thực tế. Vì vậy, đây là kết quả tự báo cáo của chương trình, chưa phải kiểm toán độc lập về hiệu quả bảo mật.
Đổi quyền truy cập lấy xác minh và giám sát
Tài liệu vận hành CVP yêu cầu người đăng ký cung cấp danh tính, mô tả công việc và xác nhận các biện pháp bảo mật. Anthropic đặt mục tiêu phản hồi hoặc yêu cầu bổ sung thông tin trong bảy ngày làm việc, nhưng Red Team và Specialized có thể mất lâu hơn. Quyền đã cấp vẫn có thể bị thu hẹp hoặc thu hồi.
Dữ liệu sử dụng thường phải được lưu để Anthropic theo dõi hành vi lạm dụng. Một số tổ chức đã có quyền zero-data-retention với Claude Fable hoặc Mythos được ngoại lệ, còn giải pháp Enterprise Frontier Safeguards dự kiến cho phép lưu dữ liệu trong hạ tầng khách hàng. Defense Access phải chuyển sang MFA chống phishing và ngừng dùng API key trước ngày 15/12/2026; trong thời gian chuyển đổi, API key hết hạn sau bảy ngày.
Một mô hình quản trị quyền, chưa phải lời giải cuối
Cách tiếp cận của Anthropic biến bộ lọc từ một công tắc chung thành chính sách dựa trên vai trò, mục đích và mức kiểm soát của tổ chức. Điều này hợp lý với an ninh mạng, nơi cùng một chuỗi lệnh có thể là kiểm thử hợp pháp hoặc tấn công trái phép. Nó cũng tạo thêm việc cho đội tuân thủ: quản lý ghế, danh tính, log, phạm vi ủy quyền và dữ liệu nhạy cảm gửi tới mô hình.
Câu hỏi tiếp theo là quy trình có mở rộng ra ngoài nhóm tổ chức lớn hay không, tỷ lệ chặn nhầm trong công việc thật giảm bao nhiêu và cơ chế phát hiện lạm dụng phản ứng nhanh thế nào. CVP mở thêm công cụ cho người phòng thủ, nhưng không thay thế sandbox, phân đoạn mạng, phê duyệt con người hoặc quy tắc chỉ kiểm thử tài sản được ủy quyền. Giá trị của chương trình sẽ được quyết định bởi kết quả vá lỗi và sự cố tránh được, không chỉ số tác vụ mô hình có thể hoàn thành.