Claude Opus 5 nguy hiểm đến mức nào mà Anthropic phải dè chừng trước khả năng tấn công mạng?

K
Kaya
Phản hồi: 0

Kaya

Writer
Claude Opus 5 vừa được Anthropic giới thiệu với khả năng tìm kiếm lỗ hổng phần mềm gần ngang các mô hình AI hàng đầu hiện nay. Tuy nhiên, điều đáng chú ý là hãng lại chủ động hạn chế khả năng khai thác các lỗ hổng đó thành mã tấn công. Chúng có thể chỉ ra "cánh cửa đang mở" nhưng sẽ từ chối hướng dẫn cách đột nhập vào bên trong.

Đây là một chiến lược khá khác so với cuộc đua AI trước đây, khi các hãng thường tập trung chứng minh mô hình của mình mạnh hơn đối thủ ở mọi bài kiểm tra. Với Anthropic, mục tiêu là giúp AI hỗ trợ lập trình viên, chuyên gia bảo mật và doanh nghiệp phát hiện rủi ro, nhưng hạn chế tối đa việc công cụ này bị lợi dụng bởi tin tặc.
1785382528026.png

Thực tế, việc AI ngày càng giỏi tìm lỗ hổng đang đặt ra một bài toán mới cho ngành an ninh mạng. Nếu cùng một mô hình vừa có thể phát hiện điểm yếu, vừa có thể tự động viết mã khai thác hoàn chỉnh, ranh giới giữa công cụ phòng thủ và vũ khí tấn công sẽ trở nên rất mong manh.

Chính vì vậy, Claude Opus 5 vẫn cho phép phân tích mã nguồn để phát hiện lỗi bảo mật, nhưng sẽ chặn các yêu cầu liên quan đến quét lỗ hổng trên tệp nhị phân, kiểm thử xâm nhập hoặc tạo exploit. Khi gặp những yêu cầu vượt ngưỡng an toàn, hệ thống sẽ tự động chuyển sang một phiên bản AI có mức giới hạn cao hơn.

Xu hướng mới của các hãng AI trong tương lai có lẽ thay vì chỉ chạy đua về điểm benchmark, họ bắt đầu cạnh tranh ở khả năng cân bằng giữa hiệu năng và mức độ an toàn.

Đối với giới an ninh mạng, đây có thể là tín hiệu tích cực. AI vẫn hỗ trợ phát hiện và vá lỗ hổng nhanh hơn nhưng nguy cơ trở thành "trợ lý viết exploit" cho tội phạm mạng sẽ được giảm bớt.

Nhưng khi các mô hình AI tiếp tục mạnh lên trong vài năm tới, liệu những "hàng rào an toàn" này có còn đủ để ngăn chặn việc bị lạm dụng hay không? Bạn có muốn hạn chế thêm tính năng nào của AI trong tương lai để đảm bảo tính an toàn trên không gian mạng không?​
 
Được phối hợp thực hiện bởi các chuyên gia của Bkav, cộng đồng An ninh mạng Việt Nam WhiteHat và cộng đồng Khoa học công nghệ VnReview
Back
Top