Chương trình CVP cải tiến là sự hợp nhất từ hai sáng kiến triển khai trong nửa năm qua: Project Glasswing (cho phép các tổ chức bảo vệ phần mềm trọng yếu tiếp cận Claude Mythos – mô hình AI chuyên về an ninh mạng mạnh nhất của hãng) và chương trình CVP ban đầu (cung cấp quyền truy cập ít hạn chế hơn vào các mô hình Claude Opus và Sonnet). Việc thử nghiệm Claude Mythos từng dấy lên lo ngại về nguy cơ AI bị lợi dụng để khai thác lỗ hổng phần mềm trước khi giới bảo mật kịp khắc phục.
Chương trình CVP mới được thiết kế theo 3 cấp độ phân quyền, áp dụng cho các mô hình tiên tiến như Claude Opus 5.5, Sonnet 5.5, Mythos 5.1 và các phiên bản tương lai. Cấp độ Phòng thủ (Defense) dành cho các nhóm an ninh mạng, đơn vị vận hành hạ tầng thiết yếu, cộng đồng phần mềm mã nguồn mở và các nhà nghiên cứu uy tín nhằm ứng phó sự cố, phân tích mã độc. Cấp độ Diễn tập tấn công (Red Team) cho phép các tổ chức được cấp phép thực hiện kiểm thử xâm nhập (pentest) và diễn tập mô phỏng tấn công. Cấp độ Chuyên biệt (Specialized) có ít hạn chế nhất, dành riêng cho một nhóm nhỏ tổ chức được ủy quyền đặc biệt để kiểm tra các hệ thống hạ tầng siêu xung yếu như lưới điện, điều hành bay và chuyển tiền liên ngân hàng.
Theo Anthropic, trong khuôn khổ Project Glasswing, các đối tác của công ty đã phát hiện ít nhất 129.000 lỗ hổng bảo mật được xác minh từ tháng 4 đến tháng 7 vừa qua. Hoạt động quét độc lập của Anthropic từ tháng 4 đến tháng 10 cũng phát hiện thêm 5.500 lỗ hổng khác, trong đó hơn 33.000 lỗ hổng được xếp ở mức đặc biệt nghiêm trọng hoặc rủi ro cao. Hãng nhận định số lượng lỗ hổng thực tế có thể cao gấp 5 lần do phạm vi thu thập dữ liệu hiện mới dừng lại ở một nhóm đối tác hạn chế.