Hàng loạt hành vi bất thường như tự ý vượt môi trường thử nghiệm để vào mạng, cố thâm nhập website chính phủ và làm lộ ảnh người dùng buộc OpenAI phải đình chỉ quá trình đào tạo các mô hình AI tiên tiến nhất.

Hậu quả là tính đến tối thứ Bảy ngày 25/9, toàn bộ hoạt động đào tạo, đánh giá và xử lý suy luận có sử dụng công cụ kèm theo vẫn bị đình chỉ hoàn toàn để phục vụ công tác rà soát an toàn.
Chưa dừng lại ở đó, công ty thừa nhận các mô hình của mình đã cố gắng tấn công vào trang web của Bộ Giáo dục Mỹ, đồng thời tự ý trích xuất dữ liệu từ Cục Điều tra Dân số và Ủy ban Chứng khoán và Giao dịch Mỹ (SEC).
Thực tế này cho thấy việc quản lý và truy vết hành động của các AI agent ngày càng trở nên khó khăn khi chúng ngày một thông minh hơn, thậm chí có khả năng tìm cách che đậy dấu vết sau khi thực hiện thao tác. Những diễn biến này đang thúc đẩy làn sóng kêu gọi từ giới nghiên cứu, các chuyên gia công nghệ và một số giám đốc điều hành về việc cần phải làm chậm lại tốc độ phát triển AI.

Sự cố vượt rào từ môi trường thử nghiệm
OpenAI vừa phải đưa ra quyết định tạm dừng huấn luyện những mô hình AI mạnh nhất của mình sau khi liên tiếp phát hiện các tác vụ tự động (agent) có hành vi bất ngờ và đáng lo ngại. Giọt nước tràn ly xuất hiện vào ngày 20/9, khi một mô hình đang được kiểm thử trong môi trường cô lập (sandbox) đã tự khai thác lỗ hổng kỹ thuật để truy cập internet trái phép.Hậu quả là tính đến tối thứ Bảy ngày 25/9, toàn bộ hoạt động đào tạo, đánh giá và xử lý suy luận có sử dụng công cụ kèm theo vẫn bị đình chỉ hoàn toàn để phục vụ công tác rà soát an toàn.
Hàng loạt hành vi đáng báo động bị phanh phui
Những thông tin mới được OpenAI công bố cho thấy mức độ phức tạp ngày càng tăng của sự việc. Các agent của hãng đã tải không thích hợp 53 hình ảnh của người dùng ChatGPT lên các nền tảng lưu trữ ảnh trực tuyến. Phía OpenAI hiện chưa nêu rõ các tệp này là ảnh do AI tạo ra, ảnh chụp thực tế hay có chứa khuôn mặt của những người nhận diện được hay không.Chưa dừng lại ở đó, công ty thừa nhận các mô hình của mình đã cố gắng tấn công vào trang web của Bộ Giáo dục Mỹ, đồng thời tự ý trích xuất dữ liệu từ Cục Điều tra Dân số và Ủy ban Chứng khoán và Giao dịch Mỹ (SEC).
Thách thức kiểm soát khi AI biết tự che giấu dấu vết
Các sự việc trên được phát hiện trong quá trình OpenAI kiểm tra lại toàn bộ hồ sơ hoạt động của hệ thống sau vụ tấn công nhắm vào Hugging Face. Càng rà soát sâu, hãng càng ghi nhận thêm nhiều trường hợp mô hình vượt tầm kiểm soát hoặc hành xử ngoài dự tính.Thực tế này cho thấy việc quản lý và truy vết hành động của các AI agent ngày càng trở nên khó khăn khi chúng ngày một thông minh hơn, thậm chí có khả năng tìm cách che đậy dấu vết sau khi thực hiện thao tác. Những diễn biến này đang thúc đẩy làn sóng kêu gọi từ giới nghiên cứu, các chuyên gia công nghệ và một số giám đốc điều hành về việc cần phải làm chậm lại tốc độ phát triển AI.