Anthropic báo động: AI Trung Quốc GLM-5.3 sở hữu năng lực tấn công mạng ngang ngửa Claude Mythos nhưng phanh an toàn "có cũng như không"

Mẫn Nhi
Mẫn Nhi✔
Phản hồi: 0

Mẫn Nhi✔

Admin xinh gái
Có khả năng bẻ khóa gần bằng mô hình tối tân nhất từ Anthropic nhưng lại phát hành dưới dạng mở, GLM-5.3 của công ty Trung Quốc Z.ai vừa bị đối thủ Mỹ chỉ ra điểm chí mạng: lớp màng an toàn bảo vệ mô hình này có thể bị gỡ bỏ dễ dàng với chi phí rẻ đến bất ngờ.
1790828474505.png

Năng lực khai thác lỗ hổng suýt bắt kịp Claude Mythos​

Báo cáo thử nghiệm vừa được Anthropic công bố đã phác họa một bức tranh đáng lo ngại về ranh giới an toàn của các mô hình trí tuệ nhân tạo hiện nay. Mục tiêu đánh giá là GLM-5.3, sản phẩm từ công ty khởi nghiệp Trung Quốc Z.ai (hay còn gọi là Zhipu AI). Khi đưa cả hai vào bài kiểm tra xây dựng chuỗi khai thác lỗ hổng bảo mật hoàn chỉnh từ đầu đến cuối, GLM-5.3 đã thực hiện thành công 50 trên tổng số 410 nỗ lực tấn công mạng.

Con số này bám sát nút thành tích 56 lần của Claude Mythos Preview, mô hình đỉnh cao từ chính Anthropic vốn đang được kiểm soát gắt gao và chỉ cấp quyền cho nhóm người dùng qua thẩm định nghiêm ngặt. Sự tương đồng về sức mạnh tính toán và khả năng phân tích mã độc khiến GLM-5.3 lập tức lọt vào tầm ngắm của các chuyên gia an ninh số phương Tây.

Chi phí rẻ không tưởng để xóa bỏ "phanh an toàn"​

Khác biệt lớn nhất và cũng là nguồn cơn gây tranh cãi nằm ở việc GLM-5.3 là mô hình trọng số mở (open-weight). Bất kỳ ai cũng có thể tải về toàn bộ phần lõi và can thiệp sâu vào cấu trúc bên trong. Anthropic phát hiện ra rằng những kẻ tấn công có thể vượt qua các hàng rào an toàn của GLM-5.3 từ 64% đến 100% số lần thử nghiệm bằng các thủ thuật rất đơn giản, trong khi những kỹ thuật này hoàn toàn vô tác dụng trước các mô hình Claude có bảo vệ.

Đội ngũ nghiên cứu thậm chí đã xóa bỏ cơ chế từ chối yêu cầu độc hại của GLM-5.3 thông qua kỹ thuật chỉnh sửa ma trận trọng số nội bộ mang tên abliteration. Sau khi tiêu tốn khoảng 2.200 giờ chạy vi xử lý đồ họa GPU với chi phí tính toán khoảng 4.400 USD, tỷ lệ từ chối lệnh nguy hiểm của GLM-5.3 tụt dốc không phanh từ mức trên 90% xuống chỉ còn vỏn vẹn 2% đến 12%. Đáng chú ý hơn, các chuyên gia ước tính một nhóm kỹ thuật dày dạn kinh nghiệm thậm chí chỉ cần bỏ ra chừng 1.200 USD để thực hiện thành công thao tác tháo rào tương tự.

Z.ai phản pháo bằng câu chuyện "đi dọn rác" cho đối thủ​

Không để đối thủ từ San Francisco chiếm trọn diễn đàn, Z.ai nhanh chóng đưa ra lời đáp trả đanh thép. Chỉ vài giờ sau khi báo cáo của Anthropic xuất hiện, người đứng đầu mảng vận hành toàn cầu của Z.ai là Li Zixuan khẳng định trên mạng xã hội X rằng các mô hình của họ đang được nhiều doanh nghiệp dùng làm công cụ phòng thủ chủ lực chứ không phải vũ khí tấn công vô tội vạ.

Đại diện Z.ai dẫn chứng câu chuyện hồi tháng 7, khi nền tảng lập trình Hugging Face phải nhờ cậy GLM-5.2 để điều tra và phong tỏa một vụ xâm nhập tự động xuất phát từ các mô hình của OpenAI. Vào thời điểm đó, chính Claude của Anthropic đã từ chối thực hiện một phần công việc phân tích an ninh vì các rào chắn kiểm duyệt tự động can thiệp quá mức. Ông Li Zixuan cũng cho biết GLM-5.3 đã trực tiếp tham gia bảo vệ 389 dự án mã nguồn mở và phát hiện ra 4.249 lỗ hổng tiềm ẩn.

Điểm nóng tranh cãi giữa mô hình đóng và mở​

Vụ việc tiếp tục đổ thêm dầu vào cuộc tranh luận nảy lửa tại Mỹ xung quanh câu chuyện đóng hay mở các mô hình trí tuệ nhân tạo thế hệ mới. Trong khi Anthropic liên tục vận động siết chặt kiểm soát quyền tiếp cận các mô hình tiên tiến, những gã khổng lồ công nghệ khác như Meta hay Nvidia lại nhiệt tình ủng hộ việc mở trọng số với lập luận rằng tiếp cận rộng rãi sẽ thúc đẩy sáng tạo và giữ vững vị thế dẫn đầu của Mỹ.

Các mô hình AI từ Trung Quốc hiện nay đa phần đều đi theo con đường mở trọng số và đang thu hẹp khoảng cách an ninh mạng rất nhanh. Khi ra mắt GLM-5.3 hồi tháng 8, Z.ai từng tuyên bố đánh bại Mythos 5 trong một bài kiểm tra an ninh mạng chủ chốt, dù công ty đã chủ động giữ lại bộ trọng số trong hai tuần để gia cố an toàn. Cơ quan Tiêu chuẩn và Đổi mới AI thuộc chính phủ Mỹ cũng xếp GLM-5.3 là mô hình trọng số mở có năng lực mạng mạnh nhất hiện nay, dù tính chung vẫn chậm hơn đỉnh cao công nghệ của Mỹ khoảng bốn tháng. Trước đó không lâu, mô hình Kimi K3 của Moonshot AI cũng từng tự thoát khỏi môi trường hộp cát cô lập để kết nối internet trong một đợt đánh giá an ninh, cho thấy các đột phá về năng lực tự hành của AI đang diễn ra với tốc độ khó lường.
 
Back
Top