Công ty trí tuệ nhân tạo (AI) Anthropic vừa công bố nâng cấp và mở rộng Chương trình Xác thực An ninh mạng (CVP), cho phép các chuyên gia bảo mật đã qua thẩm định tiếp cận những mô hình AI mạnh nhất của hãng với ít rào cản kiểm soát hơn, nhằm phục vụ công tác phòng thủ an ninh mạng.
Chương trình CVP cải tiến là sự hợp nhất từ hai sáng kiến được triển khai trong nửa năm qua, gồm Project Glasswing và chương trình CVP ban đầu. Trong đó, Project Glasswing cho phép các tổ chức bảo vệ phần mềm trọng yếu tiếp cận Claude Mythos, mô hình AI chuyên về an ninh mạng của Anthropic. Trong khi đó, chương trình CVP ban đầu cung cấp quyền truy cập ít hạn chế hơn vào các mô hình Claude Opus và Sonnet.
![]() |
| Anthropic mở rộng thử nghiệm AI mạnh nhất cho chuyên gia an ninh mạng |
Việc thử nghiệm Claude Mythos trước đó từng làm dấy lên lo ngại về khả năng AI bị lợi dụng để khai thác lỗ hổng phần mềm trước khi các chuyên gia bảo mật kịp khắc phục. Việc Anthropic mở rộng chương trình lần này vì vậy đi kèm cơ chế phân quyền nhằm cân bằng giữa khả năng tiếp cận công nghệ và yêu cầu kiểm soát rủi ro.
Theo Anthropic, chương trình CVP mới được thiết kế theo 3 cấp độ phân quyền, áp dụng cho các mô hình tiên tiến như Claude Opus 5.5, Sonnet 5.5, Mythos 5.1 và các phiên bản tương lai. Cấp độ Phòng thủ (Defense) dành cho các nhóm an ninh mạng, đơn vị vận hành hạ tầng thiết yếu, cộng đồng phần mềm mã nguồn mở và các nhà nghiên cứu uy tín. Nhóm này có thể sử dụng AI để ứng phó sự cố và phân tích mã độc.
Cấp độ Diễn tập tấn công (Red Team) cho phép các tổ chức được cấp phép thực hiện kiểm thử xâm nhập (pentest) và diễn tập mô phỏng các tình huống tấn công mạng. Trong khi đó, cấp độ Chuyên biệt (Specialized) có ít hạn chế nhất, nhưng chỉ dành cho một nhóm nhỏ tổ chức được Anthropic ủy quyền đặc biệt. Đối tượng hướng tới là các đơn vị kiểm tra những hệ thống hạ tầng siêu xung yếu như lưới điện, điều hành bay và hệ thống chuyển tiền liên ngân hàng.
Anthropic cho biết trong khuôn khổ Project Glasswing, các đối tác của công ty đã phát hiện ít nhất 129.000 lỗ hổng bảo mật được xác minh trong giai đoạn từ tháng 4 đến tháng 7.
Hoạt động quét độc lập của Anthropic từ tháng 4 đến tháng 10 tiếp tục phát hiện thêm 5.500 lỗ hổng. Theo công ty, trong số các lỗ hổng được phát hiện có hơn 33.000 trường hợp được xếp vào nhóm đặc biệt nghiêm trọng hoặc có rủi ro cao.
Anthropic nhận định số lượng lỗ hổng thực tế có thể cao gấp 5 lần, do phạm vi thu thập dữ liệu hiện mới giới hạn trong một nhóm đối tác nhất định.
Việc mở rộng CVP cho thấy Anthropic đang thúc đẩy ứng dụng các mô hình AI tiên tiến vào lĩnh vực an ninh mạng, đồng thời đặt trọng tâm vào cơ chế kiểm soát quyền truy cập. Với cách tiếp cận phân cấp, công ty hướng tới việc giúp các tổ chức bảo mật khai thác năng lực của AI cho mục tiêu phòng thủ, trong khi hạn chế nguy cơ công nghệ bị sử dụng sai mục đích.