Ngày 5/8, Meta xác nhận một mô hình trí tuệ nhân tạo của hãng đã khai thác hệ thống của một doanh nghiệp khác trong quá trình thử nghiệm an ninh mạng. Vụ việc lập tức làm nóng trở lại câu hỏi đang được đặt ra trong giới công nghệ và an ninh: các nhà phát triển có thể kiểm soát đến đâu những hệ thống AI ngày càng có khả năng tự động hành động, nhất là sau những sự cố tương tự liên quan đến Anthropic và OpenAI.
![]() |
| Việc mô hình AI của một tập đoàn công nghệ Mỹ khai thác trái phép dữ liệu của doanh nghiệp khác tiếp tục dấy lên lo ngại về sự vượt tầm kiểm soát của trí tuệ nhân tạo (AI) |
Theo các thông tin được công bố, những sự cố tại Meta và Anthropic có chung điểm xuất phát là lỗi cấu hình trong môi trường đánh giá, khiến các mô hình vốn được đặt trong khu vực thử nghiệm lại vô tình có đường ra internet mở. Riêng với OpenAI, một tác nhân AI được cho là đã tự khai thác một lỗ hổng chưa từng được biết đến để vượt ra ngoài giới hạn kết nối trong lúc tham gia bài kiểm tra an ninh mạng.
Những vụ việc liên tiếp này cho thấy rủi ro an ninh mạng do AI tiên tiến tạo ra không còn là giả định xa vời. Trong bối cảnh các tập đoàn công nghệ đang chạy đua phát triển mô hình mạnh hơn, chúng cũng có thể trở thành chất xúc tác thúc đẩy Washington đẩy nhanh các nỗ lực xây dựng cơ chế an toàn AI. Một số nhân vật có ảnh hưởng trong lĩnh vực này đã nhiều lần cho rằng tốc độ phát triển cần được kìm lại cho đến khi các lớp bảo vệ đủ vững chắc được thiết lập.
Meta cho biết hãng đang điều tra sự cố liên quan đến Irregular, một đơn vị độc lập thực hiện đánh giá an ninh mạng cho tập đoàn. Theo đó, lỗi cấu hình từ phía môi trường đánh giá đã vô tình cấp cho một mô hình của Meta quyền truy cập internet trong quá trình thử nghiệm.
Trong thông tin phản hồi, Meta nêu rằng mô hình này đã khai thác một lỗ hổng bảo mật trong dịch vụ của bên thứ ba, theo cách tương đồng với những trường hợp từng được ghi nhận ở các doanh nghiệp khác.
Theo The Information, dẫn các nguồn thạo tin, mô hình liên quan là Muse Spark 1.1 của Meta, sản phẩm được quảng bá là một trong những mô hình mạnh nhất của hãng cho các tác vụ lập trình thực tế và tác nhân tự động. Báo cáo này cho biết mô hình đã xâm nhập hệ thống của một công ty chưa được nêu tên và làm thay đổi môi trường nội bộ của công ty đó.
Phía Irregular, trong phản hồi với Reuters, cho rằng đây là vấn đề thuộc môi trường đánh giá, tương tự sự cố mà Anthropic đã công bố trước đó một tuần. Đại diện công ty nhấn mạnh vụ việc không phải là một cuộc thoát khỏi hộp cát thử nghiệm, cũng không phải một hành động tấn công mạng tinh vi. Irregular cũng cho biết hiện không còn vấn đề mở nào cần xử lý, đồng thời đang xây dựng một báo cáo chuyên đề nhằm chia sẻ các thực hành tốt nhất về cô lập môi trường và tổ chức đánh giá an ninh mạng đối với AI một cách an toàn.
Ở bình diện chính sách, chuỗi sự cố này đang làm gia tăng quan ngại trong giới lập pháp Mỹ về khả năng các mô hình AI ngày càng tinh vi có thể bị lợi dụng để tiến hành, hỗ trợ hoặc tự động hóa các hoạt động tấn công mạng. Một nhóm tổng chưởng lý bang thuộc đảng Cộng hòa đã yêu cầu OpenAI bảo quản toàn bộ tài liệu có thể liên quan đến vụ xâm phạm Hugging Face. Về phía mình, OpenAI cho biết sẽ xem xét yêu cầu này một cách nghiêm túc và dự kiến công bố báo cáo kỹ thuật sau khi hoàn tất rà soát sự cố.
Trước đó trong tuần, Nhà Trắng đã mời các doanh nghiệp AI hàng đầu, trong đó có Meta, Anthropic, OpenAI và Google, tham dự cuộc làm việc với các quan chức liên bang để thảo luận về khuôn khổ kiểm thử an ninh mạng tự nguyện mới được hoàn thiện dành cho các mô hình AI tiên tiến.
Theo Reuters, chính quyền Tổng thống Donald Trump đã trao đổi với đại diện các công ty về những quy tắc kiểm thử chưa được công bố, đồng thời cho biết các mô hình AI mã nguồn mở hoặc mở trọng số, như Llama của Meta và Nemotron của Nvidia, trước mắt sẽ không thuộc diện tham gia chương trình kiểm thử an toàn tự nguyện theo kế hoạch. Diễn biến này cho thấy cuộc tranh luận về an toàn AI đang chuyển từ phạm vi kỹ thuật thuần túy sang một bài toán an ninh quốc gia, nơi năng lực kiểm soát mô hình có thể trở thành yếu tố then chốt trong trật tự công nghệ mới.