Chủ nhật 04/10/2026 10:40
Hotline: 024.355.63.010
Email: banbientap.dnhn@gmail.com
Kinh tế số

Cựu chuyên gia an toàn cảnh báo OpenAI đang tăng tốc nhanh hơn khả năng kiểm soát

Sau 3 năm rưỡi tham gia xây dựng khuôn khổ chuẩn bị và giám sát báo cáo an toàn cho 12 đợt ra mắt mô hình tiên tiến, David Robinson cho rằng văn hóa ưu tiên tăng trưởng tại OpenAI đang đẩy năng lực AI tiến nhanh hơn nền tảng nghiên cứu và các lớp bảo vệ cần thiết.

Việc một cựu nhân sự phụ trách an toàn của OpenAI rời công ty và công khai chỉ trích cách tiếp cận đối với an toàn AI đang làm nóng thêm tranh luận về tốc độ phát triển công nghệ. Theo người này, văn hóa ưu tiên tăng trưởng và liên tục đẩy nhanh tiến độ có thể khiến nguy cơ sai sót gia tăng.

Trong bài viết mang tiêu đề Tôi rời OpenAI vì văn hóa của nó đã hỏng, đăng trên The Atlantic hôm thứ Bảy (3/10), David Robinson cho rằng các doanh nghiệp AI, trong đó có OpenAI, chưa thể hiện mức độ thận trọng cần thiết. Theo ông, ngành công nghiệp này cần đặt trọng tâm lớn hơn vào chuyên môn và nghiên cứu an toàn trước khi tiếp tục phát triển những hệ thống có năng lực cao hơn.

Tác nhân AI của OpenAI bị nghi tự tìm cách liên lạc trên hàng loạt website: Câu hỏi lớn về khả năng kiểm soát ChatGPT
Theo ông David Robinson, thời kỳ "xé nháp" của OpenAI đã qua, và những ứng dụng AI cần phải được kiểm soát bằng mức độ bảo vệ nghiêm ngặt

Robinson nhận định giai đoạn phát triển theo cách thử và sai không còn phù hợp. Ông cho rằng các hệ thống AI tiên tiến cần được kiểm soát bằng những lớp bảo vệ nghiêm ngặt, tương tự tiêu chuẩn đang áp dụng trong các ngành có mức độ rủi ro cao như năng lượng hạt nhân và hàng không.

Theo Robinson, OpenAI hiện phụ thuộc đáng kể vào phương thức mà công ty gọi là “triển khai lặp đi lặp lại”: đưa hệ thống ra sử dụng, sau đó bổ sung hoặc siết chặt các biện pháp bảo vệ khi vấn đề xuất hiện.

Cảnh báo này nối dài cuộc tranh luận trong ngành AI về việc các doanh nghiệp có đang tiến quá nhanh trong cuộc đua phát triển những hệ thống ngày càng mạnh hay không. OpenAI và đối thủ Anthropic từng chịu sự giám sát sau các sự cố liên quan đến việc cơ chế kiểm soát an toàn không vận hành như dự kiến hoặc hệ thống thử nghiệm cho kết quả ngoài mong đợi. Robinson cho biết ông đã làm việc tại OpenAI trong 3 năm rưỡi, tham gia xây dựng khuôn khổ chuẩn bị của công ty và giám sát báo cáo an toàn cho 12 đợt ra mắt mô hình tiên tiến. Từ kinh nghiệm này, ông đánh giá nhịp độ chạy đua từ lần ra mắt này sang lần ra mắt khác đang khiến công ty chưa đạt mức độ thận trọng cần thiết.

Phản hồi về vấn đề này, một phát ngôn viên OpenAI khẳng định công ty đang kiểm soát để năng lực của các mô hình không vượt quá khả năng quản lý và bảo mật an toàn. Theo đại diện doanh nghiệp, quá trình huấn luyện có thể được tạm dừng hoặc năng lực mô hình bị kìm lại khi xuất hiện yêu cầu giảm tốc độ.

Bên cạnh rủi ro trong quy trình triển khai, Robinson còn lưu ý rằng năng lực AI đang tiến bộ nhanh hơn mức độ hiểu biết của giới nghiên cứu về bài toán căn chỉnh — lĩnh vực nhằm bảo đảm hệ thống AI vận hành phù hợp với mục tiêu và các giá trị của con người. Khoảng cách này, theo lập luận của ông, càng làm nổi bật yêu cầu phải củng cố nền tảng an toàn trước khi tiếp tục mở rộng năng lực mô hình.

Tin bài khác
Cần Thơ tập hợp hơn 23.000 trí thức, thúc đẩy khoa học và đổi mới sáng tạo

Cần Thơ tập hợp hơn 23.000 trí thức, thúc đẩy khoa học và đổi mới sáng tạo

Đại hội Liên hiệp các Hội Khoa học và Kỹ thuật TP. Cần Thơ lần thứ I, nhiệm kỳ 2026-2031 đặt trọng tâm kết nối đội ngũ trí thức với chính quyền, doanh nghiệp và địa phương, ưu tiên nông nghiệp công nghệ cao, chuyển đổi xanh, đổi mới sáng tạo và thích ứng biến đổi khí hậu.
Excel thử nghiệm tính năng một ô chứa nhiều giá trị

Excel thử nghiệm tính năng một ô chứa nhiều giá trị

Microsoft đang thử nghiệm tính năng cho phép một ô Excel lưu nhiều giá trị, mở rộng khả năng xử lý danh sách, mảng và dữ liệu lồng nhau.
Caviar ra mắt iPhone 18 Pro không camera, giá hơn 280 triệu đồng

Caviar ra mắt iPhone 18 Pro không camera, giá hơn 280 triệu đồng

Caviar giới thiệu phiên bản đặc biệt của iPhone 18 Pro, 18 Pro Max và iPhone Duo được loại bỏ hoàn toàn camera, giá khởi điểm từ 10.770 USD.
iPhone 18 và 18e có thể ra mắt vào mùa xuân 2027

iPhone 18 và 18e có thể ra mắt vào mùa xuân 2027

iPhone 18 và iPhone 18e được cho là sẽ ra mắt vào mùa xuân 2027, thay vì xuất hiện cùng dòng iPhone 18 Pro vào cuối năm 2026.
AI, Deepfake mở mặt trận mới trong cuộc chiến chống gian lận tài chính

AI, Deepfake mở mặt trận mới trong cuộc chiến chống gian lận tài chính

Sự phát triển của AI, Deepfake, DeepVoice cùng quá trình số hóa tín dụng đang làm thay đổi nhanh phương thức gian lận tài chính tiêu dùng. Trong bối cảnh đó, yêu cầu đặt ra không phải gia tăng mọi lớp kiểm soát, mà là nhận diện đúng rủi ro để vừa bảo vệ khách hàng, vừa duy trì khả năng tiếp cận tín dụng chính thức.
Ông Trump nói không với siết AI, loạt tỷ phú công nghệ chọn cơ chế “tự giám sát”

Ông Trump nói không với siết AI, loạt tỷ phú công nghệ chọn cơ chế “tự giám sát”

Tổng thống Mỹ Donald Trump tiếp tục phát đi thông điệp cứng rắn với các đề xuất siết quản lý trí tuệ nhân tạo (AI), sau cuộc gặp quy tụ hàng loạt tỷ phú và lãnh đạo công nghệ tại Nhà Trắng. Động thái diễn ra trong bối cảnh những lo ngại về an toàn AI và an ninh mạng ngày càng gia tăng.
Apple phát hành iOS 27.0.1, sửa lỗi Face ID trên iPhone 18 Pro

Apple phát hành iOS 27.0.1, sửa lỗi Face ID trên iPhone 18 Pro

Apple phát hành iOS 27.0.1, tập trung sửa lỗi Face ID trên iPhone 18 Pro và iPhone 18 Pro Max cùng một số lỗi camera, màn hình cảm ứng.
OpenAI mở rộng khả năng của tác nhân AI Codex

OpenAI mở rộng khả năng của tác nhân AI Codex

OpenAI bổ sung loạt tính năng cho Codex, mở rộng khả năng hỗ trợ lập trình từ máy tính cá nhân lên thiết bị di động, môi trường đám mây và bảo mật mã nguồn.
Anthropic đặt mục tiêu IPO 100 tỷ USD, định giá có thể lên 2.000 tỷ USD

Anthropic đặt mục tiêu IPO 100 tỷ USD, định giá có thể lên 2.000 tỷ USD

Anthropic được cho là chuẩn bị IPO với mục tiêu huy động 100 tỷ USD, trong khi mức định giá dự kiến có thể lên tới 2.000 tỷ USD.
Google khai tử Gems, chuyển sang hệ thống Skills trên Gemini

Google khai tử Gems, chuyển sang hệ thống Skills trên Gemini

Google sẽ loại bỏ Gems trên Gemini từ ngày 17/11/2026 và tự động chuyển các công cụ này sang hệ thống mới mang tên Skills.
Meta mở rộng tính năng giám sát dành cho phụ huynh trên Threads tại Việt Nam

Meta mở rộng tính năng giám sát dành cho phụ huynh trên Threads tại Việt Nam

Meta chính thức triển khai tính năng giám sát dành cho phụ huynh trên Threads tại Việt Nam từ ngày 29/9, cho phép theo dõi thời gian sử dụng, đặt giới hạn hằng ngày và quản lý một số cài đặt về quyền riêng tư, nội dung.
Đức Giáo hoàng Lêô XIV kêu gọi tăng giám sát rủi ro AI

Đức Giáo hoàng Lêô XIV kêu gọi tăng giám sát rủi ro AI

Quan điểm của Đức Giáo hoàng Lêô XIV làm gia tăng tranh luận về cách cân bằng giữa tốc độ đổi mới và an toàn công nghệ, trong bối cảnh Nvidia đề cao cơ chế tự quản còn Mỹ ưu tiên lợi thế cạnh tranh trước Trung Quốc.
Apple tăng cường bảo vệ trẻ em trên iPhone, iPad với loạt tính năng mới

Apple tăng cường bảo vệ trẻ em trên iPhone, iPad với loạt tính năng mới

Apple bổ sung loạt tính năng trên iOS 27, iPadOS 27 và macOS 27, giúp phụ huynh kiểm soát nội dung, liên lạc và thời gian trẻ sử dụng thiết bị.
AI của OpenAI tự vượt rào, xâm nhập cổng dữ liệu y tế Australia: Lời xin lỗi đến sau 84 ngày

AI của OpenAI tự vượt rào, xâm nhập cổng dữ liệu y tế Australia: Lời xin lỗi đến sau 84 ngày

Một mô hình của OpenAI đã tự tìm cách vượt cơ chế bảo vệ để truy cập trái phép cổng thống kê dịch vụ y tế Medicare của Australia, qua đó phát đi cảnh báo mới về rủi ro từ AI tự chủ. Công ty Mỹ thừa nhận phản ứng chậm, gửi lời xin lỗi tới Chính phủ và người dân Australia, đồng thời cam kết hỗ trợ nước này tăng cường năng lực phòng thủ mạng.
Nvidia tung “lá chắn” cho tác nhân AI, tuyên bố có thể chặn vụ xâm nhập Hugging Face

Nvidia tung “lá chắn” cho tác nhân AI, tuyên bố có thể chặn vụ xâm nhập Hugging Face

Trong bối cảnh các tác nhân AI ngày càng trở thành mục tiêu lẫn công cụ của các cuộc tấn công mạng, Nvidia giới thiệu bộ giải pháp bảo mật mới, khẳng định công nghệ này có thể đã ngăn vụ xâm nhập Hugging Face và sẽ được triển khai cùng hàng chục đối tác.