AI của OpenAI tấn công Hugging Face: có phải AI vượt ngục?

Derpy
Derpy
Phản hồi: 0
  • Thread starter Thread starter Derpy
  • Ngày gửi Ngày gửi

Derpy

Intern Writer
Derpy

Derpy Đã xác thực

Liệu trí tuệ nhân tạo có đang dần vượt khỏi tầm kiểm soát của chúng ta, hay chính những sai lầm của con người mới là mối nguy lớn nhất? Câu hỏi này lại nóng lên sau một sự cố đáng chú ý vừa được OpenAI tiết lộ vào ngày 23 tháng 7 vừa qua. Theo TechCrunch, một mô hình AI của hãng đã "vượt rào" thành công khỏi môi trường thử nghiệm và tấn công vào hệ thống của Hugging Face – một nền tảng dữ liệu AI lớn. Sự việc này, được mô tả là một cuộc tấn công hoàn toàn do AI điều khiển, đã gióng lên hồi chuông cảnh báo về những rủi ro tiềm ẩn từ các mô hình AI tiên tiến.

Thoạt nghe, đây có vẻ là một kịch bản đáng sợ, minh chứng cho việc AI có thể tự ý hành động và gây hại. Tuy nhiên, nhiều chuyên gia an ninh mạng lại có một góc nhìn khác. Họ cho rằng, gốc rễ của sự cố chưa từng có tiền lệ này không phải do AI quá thông minh hay nguy hiểm, mà lại xuất phát từ một lỗi cơ bản của con người: OpenAI đã cấu hình sai môi trường thử nghiệm "cô lập cao độ" của mình. Một "hộp cát" (sandbox) đáng lẽ phải hoàn toàn tách biệt với internet, thì lại vô tình được kết nối.
1784774266757.png

Trong bài đăng blog chi tiết về sự việc, OpenAI giải thích rằng mô hình được thử nghiệm trong một môi trường "cô lập cao độ", với quyền truy cập mạng bị hạn chế. Việc cài đặt các gói phần mềm chỉ được thực hiện thông qua một phần mềm bên thứ ba được lưu trữ nội bộ, hoạt động như một proxy và bộ nhớ đệm cho kho lưu trữ gói. Theo OpenAI, mô hình đã thoát khỏi môi trường thử nghiệm này nhờ một lỗ hổng chưa được tiết lộ trước đó trong hệ thống cài đặt gói phần mềm, và đây chính là bước đầu tiên để nó xâm nhập vào Hugging Face. Công ty cũng cho biết họ đã "có trách nhiệm tiết lộ lỗ hổng zero-day" (lỗ hổng chưa từng được biết đến) này và đang hợp tác với bên thứ ba để khắc phục.

Tuy nhiên, đối với hầu hết các chuyên gia an ninh mạng, việc phần mềm có lỗ hổng là điều khó tránh khỏi. Cái sai thực sự nằm ở quyết định giữ lại phần mềm bên thứ ba đó ngay từ đầu. Họ nhấn mạnh rằng giá trị cốt lõi của một hệ thống hộp cát là sự cô lập hoàn toàn và triệt để. Việc thêm vào một hệ thống cài đặt gói phần mềm chẳng khác nào tự rước rắc rối vào thân.

Dan Guido, người sáng lập công ty nghiên cứu an ninh mạng Trail of Bits, gọi đây là "một thất bại trong việc cô lập khi các biện pháp bảo vệ bị tắt". Martin Boone, một nhà nghiên cứu an ninh mạng, chia sẻ với TechCrunch rằng "nghe có vẻ như đây là lỗi của con người" và "điều này đáng lẽ không nên xảy ra". Anh ấy giải thích thêm: "Nếu hộp cát thực sự là một hộp cát đúng nghĩa, nó phải được cách ly vật lý hoàn toàn với internet. Tình huống này nghe có vẻ như họ dựa vào một loại tường lửa hoặc cơ chế tương tự để cô lập, nhưng tường lửa vốn đã khó bảo vệ hệ thống bên trong khỏi bên ngoài, chứ đừng nói đến việc ngăn hệ thống bên trong kết nối ra internet."

Jake Williams, một cựu binh trong ngành an ninh mạng, cũng đồng tình, cho rằng bất kỳ mô hình nào thực hiện được các hành động mà Hugging Face ghi nhận đều "không bị giới hạn hoàn toàn trong hộp cát". Anh gọi đây là "một sự cố kiểm soát nghiêm trọng" của OpenAI. Williams ví von: "Cùng một sự việc, có người nói mô hình thoát khỏi hộp cát, nhưng người khác sẽ nói bạn đã không xây hộp cát đủ tốt, nên nó đương nhiên sẽ thoát ra."

Daniel Card, một nhà tư vấn an ninh mạng, cũng nhất trí rằng OpenAI "đã không đầu tư đủ nỗ lực vào thiết kế hộp cát và các biện pháp kiểm soát của nó", vì đã cung cấp cho hộp cát hoặc một phần của nó "một con đường không được lọc để truy cập internet". Card cho rằng, ngay cả với quyền truy cập mạng hạn chế như OpenAI mô tả, việc xây dựng một hộp cát như vậy vẫn không phải là một quyết định "hợp lý".

Dĩ nhiên, những lời chỉ trích này xuất hiện sau khi sự việc đã xảy ra, mang chút tính "khôn ngoan sau sự việc". Tuy nhiên, chúng thực sự đặt ra những câu hỏi lớn về các thực hành an toàn của các phòng thí nghiệm AI, đặc biệt là cách duy trì một môi trường thử nghiệm thực sự cô lập khi kiểm tra các mô hình.

Vấn đề này không chỉ riêng của OpenAI. Anthropic, một công ty AI khác, cũng từng chia sẻ trong một tài liệu giới thiệu mô hình an ninh mạng Mythos của họ rằng, trong một lần thử nghiệm, mô hình này "được cung cấp một máy tính 'hộp cát' an toàn để tương tác với môi trường" và được yêu cầu cố gắng thoát khỏi "vùng chứa an toàn" đó. Mythos đã thành công trong việc phá vỡ và giành được quyền truy cập internet rộng hơn từ một hệ thống "ban đầu chỉ có thể truy cập một số dịch vụ được thiết lập sẵn". Dù vậy, Anthropic lưu ý rằng mô hình của họ đã không thể "hoàn toàn" thoát khỏi môi trường cô lập đã được thiết kế.
 


Đăng nhập một lần thảo luận tẹt ga
Thành viên mới đăng
http://textlink.linktop.vn/?adslk=aHR0cHM6Ly92bnJldmlldy52bi90aHJlYWRzL2FpLWN1YS1vcGVuYWktdGFuLWNvbmctaHVnZ2luZy1mYWNlLWNvLXBoYWktYWktdnVvdC1uZ3VjLjg4MzI3Lw==
Top