Nvidia có giải pháp ngăn chặn tác nhân AI hoạt động sai trái

Mạnh Quân
Mạnh Quân✔
Phản hồi: 0
CNBC báo cáo Nvidia vừa hôm nay công bố Nền tảng An toàn Tác nhân Mở (Open Agent Safety Platform), cho phép các nhà phát triển thiết lập biện pháp bảo vệ để tác nhân AI không thoát khỏi tầm kiểm soát.

Động thái này diễn ra sau khi OpenAI, Anthropic, Meta và Google tiết lộ các sự cố gần đây, trong đó mô hình AI của họ thoát khỏi môi trường thử nghiệm và cố tấn công các công ty khác để truy cập hệ thống máy tính.

Một đại diện Nvidia cho biết nền tảng này có thể đã ngăn được vụ việc của OpenAI hồi tháng 7. Khi đó, mô hình của OpenAI thoát kiểm soát, truy cập internet mở và xâm nhập Hugging Face, công ty vận hành nền tảng phát triển mã nguồn mở. Ông Justin Boitano, phó chủ tịch phụ trách AI doanh nghiệp của Nvidia, nói Hugging Face đã báo cáo hơn 17.000 tác nhân tấn công hạ tầng của họ trong nhiều ngày và nhiều tuần. Ông nhấn mạnh mỗi sự cố bảo mật đều độc nhất và cần được xem xét chi tiết.
1790587742830.png
Theo ông Boitano, các sự cố này cho thấy biện pháp bảo vệ ở cấp độ mô hình không thể tự kiểm soát những gì tác nhân được truy cập hoặc thực hiện.

Nền tảng gồm hai thành phần chính. Nvidia OpenShell chạy trên bộ xử lý trung tâm và đặt giới hạn cho khả năng của tác nhân. Sentry là công cụ giám sát tác nhân, chạy trên chip mạng thay vì CPU hay GPU.

Một phần phần mềm là mã nguồn mở. Nvidia gọi đây là thiết kế tham chiếu, nghĩa là các đối tác sẽ xây dựng sản phẩm dựa trên nền tảng này để đưa ra thị trường. Các đối tác được nêu tên gồm Cisco, Microsoft, Oracle, CoreWeave, Dell, HPE, Lenovo, ARM và Intel. Nvidia cũng hợp tác với Anthropic để tích hợp các tác nhân quản lý trên đám mây với OpenShell.

Nvidia là công ty có giá trị nhất thế giới và giữ vai trò trung tâm trong làn sóng AI tạo sinh từ khi ChatGPT ra mắt gần bốn năm trước. Gần đây, CEO Jensen Huang trở thành tiếng nói quan trọng trong cuộc tranh luận về an toàn AI. Ông cho rằng nhiều lo ngại về bảo mật là vấn đề kỹ thuật có thể giải quyết bằng khoa học máy tính và phát triển sản phẩm.

Hai tuần trước, CEO Anthropic Dario Amodei gây tranh cãi khi kêu gọi các nhà phát triển làm chậm tiến độ vì lo ngại mô hình vượt tầm kiểm soát. Quan điểm này được Sam Altman của OpenAI và Elon Musk của SpaceX ủng hộ.
 
Back
Top