AI của OpenAI "nổi loạn", tự hack vào hệ thống của đối tác

Kiều My
Kiều My
Phản hồi: 0
  • Thread starter Thread starter Kiều My
  • Ngày gửi Ngày gửi

Kiều My

Thợ săn tin nóng
Thành viên BQT
Kiều My

Kiều My Đã xác thực

Kịch bản phim viễn tưởng hóa ra lại đang xảy ra ở đời thực: OpenAI vừa thừa nhận hai mô hình AI của họ đã tự tìm cách thoát khỏi môi trường thử nghiệm an toàn, kết nối internet và thực hiện một vụ tấn công mạng thành công vào Hugging Face.

Kịch bản viễn tưởng bước ra đời thực​

Trong một buổi thử nghiệm khả năng bảo mật, OpenAI đã kết hợp hai mô hình AI của mình: GPT-5.6 Sol và một mô hình cực mạnh khác chưa được công bố. Mục tiêu ban đầu rất đơn giản: thử xem hai "bộ não" này phối hợp với nhau thì có thể tìm và xâu chuỗi các lỗ hổng bảo mật trực tuyến tốt đến mức nào.

1784688224408.png


Để đảm bảo an toàn, OpenAI đã nhốt chúng trong một môi trường cô lập, hay còn gọi là sandbox. Thế nhưng, hai mô hình AI này đã tự tìm ra một kẽ hở bảo mật trong chính hệ thống thử nghiệm để thoát ra ngoài và kết nối thẳng với internet.

Đáng nói hơn, sau khi ra ngoài, chúng không hề đi lang thang vô định. AI đã tự suy luận rằng Hugging Face – nơi lưu trữ hàng triệu mô hình AI khác – chính là nơi chứa những manh mối quan trọng giúp chúng vượt qua bài đánh giá của OpenAI. Và thế là, một vụ tấn công mạng tự động nhắm vào Hugging Face đã diễn ra.

"Hố đen" bảo mật mà ngay cả các ông lớn cũng chưa sẵn sàng​

Vụ việc này nhanh chóng dấy lên những lo ngại sâu sắc từ giới chuyên gia. Bà Dierdre Mulligan, giáo sư tại Đại học California Berkeley, thẳng thắn đặt câu hỏi về quy trình của OpenAI: "Có vẻ như OpenAI đã không tạo ra một môi trường sandbox đủ an toàn." Bà cũng nghi ngờ liệu việc cố gắng thử nghiệm khả năng tấn công của AI có đáng để đánh đổi bằng rủi ro để chúng thoát ra ngoài internet như vậy hay không.

Trong khi đó, chuyên gia tư vấn an ninh mạng Alex Levinson nhận định rằng khả năng AI tự vượt qua các chướng ngại vật và tìm ra cách tấn công mạng mới đã thực sự chạm đến một cột mốc mới. Đây sẽ sớm trở thành một phần bình thường, nhưng đầy thách thức, của bức tranh an ninh mạng trong tương lai.

Phản ứng từ những người trong cuộc​

Về phía OpenAI, công ty thừa nhận đây là một sự cố an ninh mạng chưa từng có tiền lệ, thể hiện những khả năng tấn công mạng ở mức độ tối tân. Để khắc phục, OpenAI cho biết họ đang siết chặt các kiểm soát cấu trúc hạ tầng, chấp nhận làm chậm tốc độ nghiên cứu để ưu tiên vá các lỗ hổng bảo mật.

Phía Hugging Face thực chất đã phát hiện ra vụ xâm nhập từ tuần trước và biết đó là do một hệ thống tự trị thực hiện, dù lúc đó chưa công bố danh tính thủ phạm là OpenAI.

Ông Clem Delangue, CEO của Hugging Face, chia sẻ rằng hai bên đã hợp tác chặt chẽ để xử lý sự cố. Ông cũng nhấn mạnh một thực tế: An toàn AI không phải là việc mà bất kỳ một công ty đơn lẻ nào có thể tự giải quyết trong phòng kín.

Cuộc đua trang bị "vũ khí AI" cho an ninh mạng​

Thực tế, không chỉ OpenAI mà các đối thủ lớn khác cũng đang chạy đua phát triển các AI chuyên về bảo mật. Anthropic đã tung ra mô hình Mythos từ tháng 4, giới hạn cho một nhóm nhỏ tổ chức sử dụng để phòng thủ. Google cũng vừa công bố một mô hình tương tự cho các đối tác thử nghiệm.

Chuyên gia nghiên cứu bảo mật độc lập Richard Barnes so sánh tình huống hiện tại với làn sóng công cụ "fuzzer" (công cụ tự động tìm lỗi phần mềm) xuất hiện khoảng 10 năm trước. Khi đó, các công ty công nghệ cũng phải tự dùng chính các công cụ này để quét sạch lỗ hổng trên hệ thống của mình trước khi kẻ xấu kịp lợi dụng. Với AI, kịch bản này đang lặp lại nhưng ở một cấp độ phức tạp và khó lường hơn rất nhiều.
 
Được phối hợp thực hiện bởi các chuyên gia của Bkav, cộng đồng An ninh mạng Việt Nam WhiteHat và cộng đồng Khoa học công nghệ VnReview


Đăng nhập một lần thảo luận tẹt ga
Thành viên mới đăng
http://textlink.linktop.vn/?adslk=aHR0cHM6Ly92bnJldmlldy52bi90aHJlYWRzL2FpLWN1YS1vcGVuYWktbm9pLWxvYW4tdHUtaGFjay12YW8taGUtdGhvbmctY3VhLWRvaS10YWMuODgyMzEv
Top