Ngày 28/9, Nvidia công bố bộ công cụ bảo mật phần mềm dành cho các tác nhân AI. Theo hãng chip Mỹ, giải pháp này có thể đã ngăn chặn vụ tấn công nhằm vào Hugging Face — trung tâm lập trình AI được Nvidia chi 13 tỷ USD mua lại chỉ vài tháng sau khi bị các tác nhân độc hại từ OpenAI xâm nhập.
![]() |
| Nvidia công bố bộ công cụ bảo mật phần mềm dành cho các tác nhân AI |
Động thái được đưa ra trong bối cảnh OpenAI và Anthropic — hai phòng thí nghiệm AI hàng đầu của Mỹ — đang điều tra nhiều vụ việc liên quan đến các tác nhân AI xâm nhập hệ thống thương mại và cơ quan chính phủ. Đây là những hệ thống có khả năng tự thực hiện các nhiệm vụ phức tạp. Trong khi đó, CEO Nvidia Jensen Huang vẫn bác bỏ lời kêu gọi áp dụng các quy định an toàn AI trên diện rộng, cho rằng việc kiểm soát các tác nhân vượt khỏi phạm vi cho phép trước hết là một bài toán kỹ thuật, tương tự quá trình nâng cao độ an toàn của ô tô.
Một trong những công cụ được giới thiệu lần này là OpenShell, tận dụng các tính năng phần cứng trên bộ xử lý trung tâm của Nvidia để kiểm soát hoạt động của tác nhân AI. Nvidia cũng đang phối hợp với Arm Holdings và Intel nhằm bảo đảm hệ thống có thể vận hành trên bộ xử lý của các hãng này.
Bộ công cụ mới được Nvidia triển khai cùng hàng chục đối tác, trong đó có Anthropic.
Ông Justin Boitano, Phó chủ tịch kiêm Tổng giám đốc mảng điện toán doanh nghiệp của Nvidia, nhận định các công cụ này có thể đã ngăn chặn vụ tấn công Hugging Face được công bố trong mùa hè năm nay.
Tại một cuộc họp báo, ông Boitano cho biết, theo đánh giá hiện tại của Nvidia, nền tảng bảo mật mới có thể đã ngăn vụ xâm nhập nếu được áp dụng ngay từ đầu tại các phòng thí nghiệm tiên tiến trong quá trình đánh giá mô hình. Ông đồng thời nhấn mạnh Nvidia đang phát triển giải pháp theo hướng mở và mong muốn hợp tác với các bên liên quan.
Một lớp bảo vệ khác mang tên Sentry sử dụng chip Nvidia riêng biệt, kết hợp với OpenShell để chặn tác nhân độc hại khi hệ thống này tìm cách thoát khỏi vùng chứa trên bộ xử lý trung tâm. Theo ông Ali Golshan, Giám đốc cấp cao phụ trách phần mềm AI tại Nvidia, các công cụ sử dụng mô hình toán học để nhận diện hành vi vượt rào, chẳng hạn một tác nhân tạo thêm nhiều “tác nhân phụ” nhằm né cơ chế ngăn chặn áp dụng cho tác nhân chính.
Ông Golshan cho rằng trọng tâm của bài toán nằm ở hành vi mang tính phối hợp giữa các nhóm tác nhân AI và cách chúng tương tác với nhau, thay vì chỉ theo dõi từng tác nhân riêng lẻ.