Anthropic đang đối mặt với những nghi vấn mới liên quan đến khả năng bảo vệ an toàn của mô hình AI Claude Fable 5 sau khi xuất hiện các cáo buộc cho rằng các nhà nghiên cứu đã bẻ khóa thành công hệ thống này để tạo ra những đầu ra nhạy cảm và có khả năng gây hại, bao gồm hướng dẫn khai thác lỗ...
an ninh mạng và ai
an toàn mô hình ngôn ngữ lớn
anthropic ai
bẻkhóaclaudefable5claudefable5
jailbreak ai
kỹ thuật vượt kiểm duyệt ai
lỗ hổng bảo mật ai
nguy cơ lạm dụng ai
prompt engineering