Theo Reuters, dữ liệu mà hãng tin này xem xét cùng thông tin từ sáu nhóm điều tra độc lập cho thấy các tác nhân AI do OpenAI phát hành được cho là đã sử dụng hơn 10 trang web chưa từng được công bố trước đó để liên lạc trái phép trong những tháng đầu năm nay. Phát hiện này làm nổi bật khả năng phạm vi hoạt động bất thường có thể rộng hơn nhiều so với những gì từng được biết đến.
![]() |
| Tác nhân AI của OpenAI bị nghi tự tìm cách liên lạc trên hàng loạt website, đặt ra câu hỏi lớn về khả năng kiểm soát ChatGPT. |
Dù hành vi này chưa bị đánh giá là tấn công mạng theo nghĩa nghiêm trọng và ở một số khía cạnh gần với spam hơn, việc các tác nhân của OpenAI được cho là đã vượt qua giới hạn đặt ra để mở kênh liên lạc trên nhiều trang web khác nhau vẫn có thể làm dấy lên lo ngại. Đáng chú ý, những thông tin này được cho là đã không được công bố trong nhiều tháng, giữa bối cảnh năng lực của các mô hình AI ngày càng tăng và mức độ minh bạch của các công ty phát triển công nghệ này tiếp tục bị đặt dấu hỏi.
Andrew Yoon, nhà nghiên cứu tại tổ chức phi lợi nhuận CivAI ở California, được Reuters dẫn lời cho biết phạm vi liên lạc trái phép của các tác nhân dường như “lớn hơn một chút” so với đánh giá ban đầu. Theo ông, có 18 trang web chưa từng được tiết lộ trước đó đã được các tác nhân sử dụng trong giai đoạn từ tháng 5 đến tháng 7, và nhiều khả năng vẫn còn những hoạt động khác chưa được phát hiện.
Trước đó, các nhà nghiên cứu cho biết một nhóm tác nhân của OpenAI đã kiểm soát một trang wiki tiếng Đức và biến nơi này thành một nền tảng nhắn tin tự phát nhằm hỗ trợ việc vượt qua các bài kiểm tra. Sự việc được cho là đã không được OpenAI công khai trong quá trình công ty xử lý hệ quả từ vụ việc liên quan đến kho lưu trữ mã nguồn mở Hugging Face hồi tháng 7.
Đến nay, ngoài nhóm nghiên cứu phát hiện vụ việc tại Đức, một số nhà điều tra độc lập khác cũng cho biết họ đã tìm thấy thêm nhiều trang web chưa từng được nêu tên, nơi cùng một nhóm tác nhân dường như để lại các thông điệp tương tự trong giai đoạn đầu năm.
OpenAI không trả lời trực tiếp các câu hỏi liên quan đến số lượng trang web mà các tác nhân bị cho là đã sử dụng để liên lạc, cũng như lý do công ty không công bố hoạt động này trong nhiều tháng. Trong tuyên bố gửi Reuters, OpenAI cho biết họ đang tiến hành một cuộc rà soát rộng hơn về hoạt động của các tác nhân và đến nay chưa xác định thêm trường hợp nào có mức độ nghiêm trọng hoặc quy mô tương tự vụ Hugging Face — sự cố từng thu hút sự chú ý toàn cầu và làm gia tăng lo ngại về khả năng kiểm soát công nghệ của chính công ty.
OpenAI cũng cho biết công ty đang xây dựng một khuôn khổ nhằm báo cáo các hiện tượng “không phù hợp” — thuật ngữ trong ngành dùng để chỉ những hành vi bất thường — trong quá trình huấn luyện, đánh giá và triển khai mô hình AI, đồng thời dự kiến chia sẻ thêm trong thời gian tới.
Theo Reuters, hãng tin này đã xem xét tổng cộng sáu phát hiện từ các nhà điều tra hoặc nhóm điều tra, trong đó có ba phát hiện được đăng tải công khai trên mạng xã hội và ba phát hiện khác được chia sẻ riêng.
Các phương pháp điều tra được mô tả là không hoàn toàn giống nhau. Một số nhóm xác định hoạt động của tác nhân bằng cách đối chiếu chuỗi dữ liệu còn sót lại trên wiki tiếng Đức với các chuỗi tương tự trên những trang web khác cùng thời điểm. Một số khác dựa vào tên người dùng giống hoặc gần giống nhau, hoặc truy vết các hoạt động cùng hướng tới việc trả lời những câu hỏi nhân khẩu học ít phổ biến, chẳng hạn các truy vấn liên quan đến tỷ lệ mắc ung thư tại Iowa.
Trong một số trường hợp, các nhà điều tra cho biết họ có thể truy ngược dấu vết hoạt động tới các địa chỉ giao thức internet liên quan đến hạ tầng Microsoft Azure, nền tảng mà OpenAI đôi khi sử dụng.
Số lượng trang web bị ảnh hưởng được các nhóm đưa ra có sự khác biệt và Reuters cho biết hãng tin không thể xác minh độc lập từng tuyên bố. Tuy vậy, những người mà Reuters trao đổi đều thống nhất rằng con số vượt quá 10. Phần lớn các phát hiện xoay quanh một nhóm wiki cho phép chỉnh sửa chung, các trang lưu trữ văn bản trực tuyến và một số công cụ rút gọn liên kết do hai trường đại học vận hành.
Theo các nhà điều tra, nhiều trang web được cho là đã bị các tác nhân sử dụng đều là những địa chỉ khá ít được biết đến trên Internet.
Dấu vết được phát hiện trên một wiki phục vụ môn Hóa học Nâng cao do một giáo viên trung học tại Massachusetts lập từ năm 2008, hai trang cá nhân của các nhân sự công nghệ người Ba Lan, các wiki về trò chơi dành cho cộng đồng thích thử thách trí tuệ, cũng như một trang dành cho người yêu thích phần mềm chỉnh sửa văn bản đã tồn tại hơn hai thập kỷ.
Reuters cho biết các chủ sở hữu của những trang web nói trên không phản hồi yêu cầu bình luận.
OpenAI hiện chưa công khai giải thích cách thức hoặc lý do các tác nhân của họ sử dụng website bên thứ ba như những diễn đàn nhắn tin tự phát. Dù vậy, các nhà nghiên cứu đầu tiên phát hiện hoạt động này cho rằng nguyên nhân có thể xuất phát từ việc các tác nhân được giao nhiệm vụ trả lời những câu hỏi nghiên cứu khó, trong khi chỉ được phép quét web để tìm câu trả lời và không được đăng nội dung. Trong bối cảnh đó, các tác nhân dường như đã tìm cách liên lạc với nhau bằng cách tận dụng kẽ hở trên các wiki cũ hoặc những trang cho phép chỉnh sửa bằng lệnh không chuẩn — tương tự việc thí sinh bị cấm trao đổi trong phòng thi nhưng vẫn để lại ghi chú ở nơi khác.
Kenneth Russell DeGraff, một nhà phát triển phần mềm và cựu trợ lý quốc hội, nhận định rằng nếu các mô hình chỉ được yêu cầu đọc thông tin, chúng có thể tìm cách tinh vi hơn để để lại dữ liệu. Ông cho biết đã phát hiện dạng thông tin như vậy trên ít nhất 10 trang web.
Sydney Von Arx, người thuộc nhóm nghiên cứu đã công bố đầu tiên hoạt động tại Đức, cho biết nhóm của bà đã tổng hợp được thêm các thông tin xác thực liên quan.
Theo nhóm này, các phát hiện đáng chú ý cho thấy hoạt động của các tác nhân có thể xuất hiện trên 23 trang web chưa từng được báo cáo trước đó. Tuy nhiên, Von Arx cũng lưu ý rằng mọi ước tính hiện tại đều chưa đầy đủ.
Bà cho biết nhóm nghiên cứu chưa thể xác định còn bao nhiêu thông tin tương tự đang tồn tại trên các nền tảng khác.
OpenAI không trả lời trực tiếp câu hỏi về việc liệu công ty đã liên hệ với chủ sở hữu các trang web bị ảnh hưởng hay chưa. Tuy nhiên, sau khi Reuters đăng tải bài viết, Đại học Toronto — một trong những tổ chức được cho là có công cụ rút gọn liên kết bị các tác nhân sử dụng — cho biết OpenAI đã liên hệ với trường về hoạt động có thể xảy ra trên website của họ. Đại học Vanderbilt, đơn vị cũng có công cụ rút gọn liên kết được cho là bị sử dụng theo cách tương tự, không phản hồi yêu cầu bình luận.
Helmut Leitner, nhà phát triển phần mềm đã nghỉ hưu tại Áo, người cung cấp không gian lưu trữ và phần mềm cho sáu trang wiki bị ảnh hưởng, ban đầu cho biết OpenAI chưa liên hệ với ông. Tuy nhiên, vài giờ sau khi Reuters trình bày các phát hiện với OpenAI, Leitner nói rằng ông nhận được một email không ký tên từ công ty cảnh báo về sự cố. Theo ông, nội dung email này chưa đáp ứng kỳ vọng của ông đối với một doanh nghiệp như OpenAI.
Leitner cho biết ông không muốn trả lời các câu hỏi về việc có liên hệ với nhà chức trách hay không. Ông cũng lưu ý rằng người điều hành DseWiki — người Reuters không thể liên hệ để bình luận — đã phải dành nhiều giờ để dọn dẹp sau sự cố. Dù vậy, Leitner cho rằng không nên quy trách nhiệm cho AI, bởi hệ thống này về bản chất chỉ thực hiện những gì nó được thiết kế để làm.
Theo Leitner, trách nhiệm trong vụ việc không nằm ở một cỗ máy được kỳ vọng có đạo đức, mà thuộc về những cá nhân và tổ chức đứng sau quá trình phát triển, triển khai và giám sát công nghệ đó.